Ling-3.0-flash
inclusionai/ling-3.0-flash
Compare with Ling-2.6-flash, Ling-2.6-1T, Ring-2.6-1T
CompareLing-3.0-flash
| Provider | State | Uptime 5m | 24h | p50 latency | p99 | Throughput | Context | $/Mtok |
|---|---|---|---|---|---|---|---|---|
DeepInfradeepinfra/bf16bf16 | Healthy | 100% | 99.80% | 885ms | 3.04s | 43 tps | 131K | $0.060 / $0.180 |
Novitanovita | Healthy | 100% | 100% | 710ms | 1.82s | 66 tps | 262K | $0.021 / $0.063 |
Novitanovita/fast | No data | — | 100% | 712ms | 1.20s | 61 tps | 262K | $0.042 / $0.126 |
- DeepInfra100%Healthy24h 99.80%
- p50
- 885ms
- p99
- 3.04s
- Throughput
- 43 tps
- Context
- 131K
- $/Mtok
- $0.060 / $0.180
deepinfra/bf16bf16 - Novita100%Healthy24h 100%
- p50
- 710ms
- p99
- 1.82s
- Throughput
- 66 tps
- Context
- 262K
- $/Mtok
- $0.021 / $0.063
novita - Novita—No data24h 100%
- p50
- 712ms
- p99
- 1.20s
- Throughput
- 61 tps
- Context
- 262K
- $/Mtok
- $0.042 / $0.126
novita/fast
Measured 1m ago. Latency and throughput are OpenRouter's rolling 30-minute windows.
History
1 endpoint reporting no data is omitted from the charts.
Availability
Axis starts at 90% so small differences stay visible; it expands to 0 when an endpoint falls below.
Time to first token
Logarithmic axis — the fleet spans two orders of magnitude. p50 and p99 are OpenRouter's rolling 30-minute windows.
Throughput
Median tokens per second.