Qwen3 235B A22B Thinking 2507
qwen/qwen3-235b-a22b-thinking-2507
Compare with Qwen3 235B A22B Instruct 2507, Qwen3 30B A3B Instruct 2507, Qwen3 Coder 480B A35B
CompareQwen3 235B A22B Thinking 2507
| Provider | State | Uptime 5m | 24h | p50 latency | p99 | Throughput | Context | $/Mtok |
|---|---|---|---|---|---|---|---|---|
Alibabaalibaba | No data | — | 99.92% | 767ms | 4.67s | 72 tps | 131K | $0.230 / $2.30 |
DeepInfradeepinfra/fp8fp8 | No data | — | 98.35% | 602ms | 2.40s | 52 tps | 262K | $0.230 / $2.30 |
Novitanovita/fp8fp8 | No data | — | 99.11% | 1.92s | 8.65s | 31 tps | 131K | $0.300 / $3.00 |
Venicevenice/fp8fp8 | No data | — | 97.02% | 945ms | 8.39s | 60 tps | 128K | $0.450 / $3.50 |
- Alibaba—No data24h 99.92%
- p50
- 767ms
- p99
- 4.67s
- Throughput
- 72 tps
- Context
- 131K
- $/Mtok
- $0.230 / $2.30
alibaba - DeepInfra—No data24h 98.35%
- p50
- 602ms
- p99
- 2.40s
- Throughput
- 52 tps
- Context
- 262K
- $/Mtok
- $0.230 / $2.30
deepinfra/fp8fp8 - Novita—No data24h 99.11%
- p50
- 1.92s
- p99
- 8.65s
- Throughput
- 31 tps
- Context
- 131K
- $/Mtok
- $0.300 / $3.00
novita/fp8fp8 - Venice—No data24h 97.02%
- p50
- 945ms
- p99
- 8.39s
- Throughput
- 60 tps
- Context
- 128K
- $/Mtok
- $0.450 / $3.50
venice/fp8fp8
Measured 2m ago. Latency and throughput are OpenRouter's rolling 30-minute windows.
History
4 endpoints reporting no data are omitted from the charts.
No endpoints with data to chart.