Qwen3.5 397B A17B
qwen/qwen3.5-397b-a17b
Compare with Qwen3.5-35B-A3B, Qwen3.5-27B, Qwen3.5-122B-A10B
CompareQwen3.5 397B A17B
| Provider | State | Uptime 5m | 24h | p50 latency | p99 | Throughput | Context | $/Mtok |
|---|---|---|---|---|---|---|---|---|
Alibabaalibaba | Healthy | 100% | 98.65% | 1.85s | 4.92s | 49 tps | 262K | $0.390 / $2.34 |
AtlasCloudatlas-cloud/fp8fp8 | Healthy | 100% | 97.00% | 1.09s | 23.7s | 53 tps | 262K | $0.550 / $3.50 |
DeepInfradeepinfra/fp8fp8 | Healthy | 100% | 98.07% | 497ms | 1.93s | 27 tps | 262K | $0.450 / $3.00 |
DigitalOceandigitalocean | Healthy | 100% | 95.93% | 921ms | 5.46s | 10 tps | 131K | $0.302 / $1.93 |
Novitanovita | Healthy | 100% | 96.45% | 586ms | 4.51s | 51 tps | 262K | $0.600 / $3.60 |
Parasailparasail/fp8fp8 | Healthy | 100% | 99.43% | 737ms | 4.34s | 45 tps | 262K | $0.500 / $3.60 |
GMICloudgmicloud/fp8fp8 | No data | — | 0.00% | — | — | — | 262K | $0.600 / $3.60 |
Phalaphala | No data | — | 98.01% | 1.52s | 5.50s | 15 tps | 262K | $0.550 / $3.50 |
StreamLakestreamlake | No data | — | 98.41% | 1.79s | 3.49s | 77 tps | 256K | $0.600 / $3.60 |
Venicevenice | No data | — | 97.77% | 1.06s | 30.5s | 65 tps | 128K | $0.750 / $4.50 |
- Alibaba100%Healthy24h 98.65%
- p50
- 1.85s
- p99
- 4.92s
- Throughput
- 49 tps
- Context
- 262K
- $/Mtok
- $0.390 / $2.34
alibaba - AtlasCloud100%Healthy24h 97.00%
- p50
- 1.09s
- p99
- 23.7s
- Throughput
- 53 tps
- Context
- 262K
- $/Mtok
- $0.550 / $3.50
atlas-cloud/fp8fp8 - DeepInfra100%Healthy24h 98.07%
- p50
- 497ms
- p99
- 1.93s
- Throughput
- 27 tps
- Context
- 262K
- $/Mtok
- $0.450 / $3.00
deepinfra/fp8fp8 - DigitalOcean100%Healthy24h 95.93%
- p50
- 921ms
- p99
- 5.46s
- Throughput
- 10 tps
- Context
- 131K
- $/Mtok
- $0.302 / $1.93
digitalocean - Novita100%Healthy24h 96.45%
- p50
- 586ms
- p99
- 4.51s
- Throughput
- 51 tps
- Context
- 262K
- $/Mtok
- $0.600 / $3.60
novita - Parasail100%Healthy24h 99.43%
- p50
- 737ms
- p99
- 4.34s
- Throughput
- 45 tps
- Context
- 262K
- $/Mtok
- $0.500 / $3.60
parasail/fp8fp8 - GMICloud—No data24h 0.00%
- p50
- —
- p99
- —
- Throughput
- —
- Context
- 262K
- $/Mtok
- $0.600 / $3.60
gmicloud/fp8fp8 - Phala—No data24h 98.01%
- p50
- 1.52s
- p99
- 5.50s
- Throughput
- 15 tps
- Context
- 262K
- $/Mtok
- $0.550 / $3.50
phala - StreamLake—No data24h 98.41%
- p50
- 1.79s
- p99
- 3.49s
- Throughput
- 77 tps
- Context
- 256K
- $/Mtok
- $0.600 / $3.60
streamlake - Venice—No data24h 97.77%
- p50
- 1.06s
- p99
- 30.5s
- Throughput
- 65 tps
- Context
- 128K
- $/Mtok
- $0.750 / $4.50
venice
Measured 2m ago. Latency and throughput are OpenRouter's rolling 30-minute windows.
History
4 endpoints reporting no data are omitted from the charts.
Availability
Axis starts at 90% so small differences stay visible; it expands to 0 when an endpoint falls below.
Time to first token
Logarithmic axis — the fleet spans two orders of magnitude. p50 and p99 are OpenRouter's rolling 30-minute windows.
Throughput
Median tokens per second.