GLM 4.7 Flash
z-ai/glm-4.7-flash
CompareGLM 4.7 Flash
| Provider | State | Uptime 5m | 24h | p50 latency | p99 | Throughput | Context | $/Mtok |
|---|---|---|---|---|---|---|---|---|
Venicevenice/fp8fp8 | Healthy | 100% | 97.93% | 740ms | 7.98s | 14 tps | 128K | $0.060 / $0.400 |
Cloudflarecloudflare | Healthy | 99.60% | 98.10% | 341ms | 8.77s | 20 tps | 131K | $0.061 / $0.400 |
DeepInfradeepinfra/bf16bf16 | Healthy | 99.22% | 99.53% | 424ms | 8.68s | 27 tps | 203K | $0.060 / $0.400 |
Novitanovita/bf16bf16 | Down | 62.65% | 93.59% | 1.50s | 124s | 19 tps | 200K | $0.070 / $0.400 |
- Venice100%Healthy24h 97.93%
- p50
- 740ms
- p99
- 7.98s
- Throughput
- 14 tps
- Context
- 128K
- $/Mtok
- $0.060 / $0.400
venice/fp8fp8 - Cloudflare99.60%Healthy24h 98.10%
- p50
- 341ms
- p99
- 8.77s
- Throughput
- 20 tps
- Context
- 131K
- $/Mtok
- $0.061 / $0.400
cloudflare - DeepInfra99.22%Healthy24h 99.53%
- p50
- 424ms
- p99
- 8.68s
- Throughput
- 27 tps
- Context
- 203K
- $/Mtok
- $0.060 / $0.400
deepinfra/bf16bf16 - Novita62.65%Down24h 93.59%
- p50
- 1.50s
- p99
- 124s
- Throughput
- 19 tps
- Context
- 200K
- $/Mtok
- $0.070 / $0.400
novita/bf16bf16
Measured 3m ago. Latency and throughput are OpenRouter's rolling 30-minute windows.
History
Availability
Axis starts at 90% so small differences stay visible; it expands to 0 when an endpoint falls below.
Time to first token
Logarithmic axis — the fleet spans two orders of magnitude. p50 and p99 are OpenRouter's rolling 30-minute windows, averaged over the hour.
Throughput
Median tokens per second.