Qwen3.6 35B A3B: providers compared
Every endpoint serving this model, side by side. ◆ marks the best value in each column — per model, never fleet-wide.
Current state
| State | ||||||||||
|---|---|---|---|---|---|---|---|---|---|---|
| Healthy | 100%◆ (best) | 100% | 99.76% | 99.80% | 524ms | 2.49s◆ (best) | 91 tps | 262K | $0.100 / $0.900 | |
| Healthy | 100%◆ (best) | 99.74% | 98.26% | 98.68% | 894ms | 5.78s | 87 tps | 262K | $0.186 / $1.11 | |
| Healthy | 100%◆ (best) | 100% | 99.90% | 98.99% | 522ms◆ (best) | 5.86s | 155 tps◆ (best) | 262K | $0.250 / $1.25 | |
| Healthy | 100%◆ (best) | 100% | 99.91% | 99.84% | 2.04s | 12.3s | 77 tps | 262K | $0.050 / $0.700◆ (best) | |
| Healthy | 100%◆ (best) | 100% | 99.03% | 96.17% | 1.19s | 25.1s | 37 tps | 262K | $0.100 / $0.950 | |
DekaLLMdekallm | Healthy | 100%◆ (best) | 99.86% | 99.63% | 99.24% | 618ms | 9.23s | 125 tps | 262K | $0.100 / $1.00 |
| Healthy | 100%◆ (best) | 99.65% | 99.86% | 99.77% | 558ms | 3.17s | 108 tps | 262K | $0.150 / $1.00 | |
Phalaphala | Healthy | 100%◆ (best) | 97.59% | 99.13% | 99.41% | 1.22s | 16.4s | 48 tps | 262K | $0.200 / $1.27 |
| Healthy | 100%◆ (best) | 99.63% | 98.87% | 98.62% | 1.68s | 12.5s | 67 tps | 262K | $0.240 / $1.80 | |
| Healthy | 100%◆ (best) | 99.71% | 99.76% | 99.84% | 810ms | 6.73s | 99 tps | 256K | $0.100 / $1.00 | |
Darkbloomdarkbloom | No data | — | — | — | — | — | — | — | 262K | $0.080 / $0.750 |
| No data | — | — | — | 95.17% | — | — | — | 262K | $0.220 / $1.20 | |
Rekareka | No data | — | — | 100%◆ (best) | 99.91%◆ (best) | — | — | — | 262K | $0.100 / $1.00 |
- AkashML100%◆ (best)Healthy24h 100%
- 7d
- 99.76%
- 30d
- 99.80%
- p50
- 524ms
- p99
- 2.49s◆ (best)
- Throughput
- 91 tps
- Context
- 262K
- $/Mtok
- $0.100 / $0.900
akashml/fp8fp8 - AtlasCloud100%◆ (best)Healthy24h 99.74%
- 7d
- 98.26%
- 30d
- 98.68%
- p50
- 894ms
- p99
- 5.78s
- Throughput
- 87 tps
- Context
- 262K
- $/Mtok
- $0.186 / $1.11
atlas-cloud/fp8fp8 - CoreWeave100%◆ (best)Healthy24h 100%
- 7d
- 99.90%
- 30d
- 98.99%
- p50
- 522ms◆ (best)
- p99
- 5.86s
- Throughput
- 155 tps◆ (best)
- Context
- 262K
- $/Mtok
- $0.250 / $1.25
coreweave/fp8fp8 - Darkbloom100%◆ (best)Healthy24h 100%
- 7d
- 99.91%
- 30d
- 99.84%
- p50
- 2.04s
- p99
- 12.3s
- Throughput
- 77 tps
- Context
- 262K
- $/Mtok
- $0.050 / $0.700◆ (best)
darkbloom/fp4fp4 - DeepInfra100%◆ (best)Healthy24h 100%
- 7d
- 99.03%
- 30d
- 96.17%
- p50
- 1.19s
- p99
- 25.1s
- Throughput
- 37 tps
- Context
- 262K
- $/Mtok
- $0.100 / $0.950
deepinfra/fp8fp8 - DekaLLM100%◆ (best)Healthy24h 99.86%
- 7d
- 99.63%
- 30d
- 99.24%
- p50
- 618ms
- p99
- 9.23s
- Throughput
- 125 tps
- Context
- 262K
- $/Mtok
- $0.100 / $1.00
dekallm - Parasail100%◆ (best)Healthy24h 99.65%
- 7d
- 99.86%
- 30d
- 99.77%
- p50
- 558ms
- p99
- 3.17s
- Throughput
- 108 tps
- Context
- 262K
- $/Mtok
- $0.150 / $1.00
parasail/fp8fp8 - Phala100%◆ (best)Healthy24h 97.59%
- 7d
- 99.13%
- 30d
- 99.41%
- p50
- 1.22s
- p99
- 16.4s
- Throughput
- 48 tps
- Context
- 262K
- $/Mtok
- $0.200 / $1.27
phala - SiliconFlow100%◆ (best)Healthy24h 99.63%
- 7d
- 98.87%
- 30d
- 98.62%
- p50
- 1.68s
- p99
- 12.5s
- Throughput
- 67 tps
- Context
- 262K
- $/Mtok
- $0.240 / $1.80
siliconflow/fp8fp8 - Venice100%◆ (best)Healthy24h 99.71%
- 7d
- 99.76%
- 30d
- 99.84%
- p50
- 810ms
- p99
- 6.73s
- Throughput
- 99 tps
- Context
- 256K
- $/Mtok
- $0.100 / $1.00
venice/fp8fp8 - No data24h —
- 7d
- —
- 30d
- —
- p50
- —
- p99
- —
- Throughput
- —
- Context
- 262K
- $/Mtok
- $0.080 / $0.750
darkbloom - No data24h —
- 7d
- —
- 30d
- 95.17%
- p50
- —
- p99
- —
- Throughput
- —
- Context
- 262K
- $/Mtok
- $0.220 / $1.20
io-net/fp8fp8 - Reka—No data24h —
- 7d
- 100%◆ (best)
- 30d
- 99.91%◆ (best)
- p50
- —
- p99
- —
- Throughput
- —
- Context
- 262K
- $/Mtok
- $0.100 / $1.00
reka
Measured 37s ago. Latency and throughput are OpenRouter's rolling 30-minute windows. ◆ marks the best value in each column among these endpoints.
Price vs latency
One dot per endpoint at the latest round · further left = faster, lower = cheaper · hover a dot for its tag
History
Availability
Axis starts at 90% so small differences stay visible; it expands to 0 when an endpoint falls below.
Time to first token
Logarithmic axis — the fleet spans two orders of magnitude. P50 is OpenRouter's rolling 30-minute window, averaged over the hour.
Throughput
Median tokens per second.