MiniMax M3: providers compared
Every endpoint serving this model, side by side. ◆ marks the best value in each column — per model, never fleet-wide.
Current state
| State | ||||||||||
|---|---|---|---|---|---|---|---|---|---|---|
| Healthy | 100%◆ (best) | 96.90% | 99.01% | 90.52% | 1.17s | 9.87s | 63 tps | 524K | $0.300 / $1.20 | |
| Healthy | 100%◆ (best) | 99.84% | 99.75%◆ (best) | 98.90% | 1.10s | 8.08s | 35 tps | 524K | $0.280 / $1.10 | |
| Healthy | 100%◆ (best) | 99.65% | 99.51% | 99.63%◆ (best) | 2.12s | 15.0s | 57 tps | 1.0M | $0.300 / $1.20 | |
| Healthy | 100%◆ (best) | 99.81% | 99.58% | 98.44% | 606ms | 2.38s◆ (best) | 169 tps◆ (best) | 1.0M | $0.300 / $1.20 | |
Togethertogether | Healthy | 100%◆ (best) | 99.45% | 99.51% | 99.54% | 1.36s | 9.09s | 21 tps | 524K | $0.300 / $1.20 |
| Healthy | 100%◆ (best) | 94.19% | 96.50% | 95.09% | 1.05s | 10.0s | 75 tps | 524K | $0.300 / $1.20 | |
| Healthy | 99.79% | 97.02% | 97.41% | 98.81% | 632ms | 8.30s | 55 tps | 262K | $0.230 / $0.960◆ (best) | |
| Healthy | 99.79% | 99.74% | 99.62% | 99.34% | 1.32s | 13.0s | 64 tps | 524K | $0.300 / $1.20 | |
| Healthy | 98.44% | 99.40% | 99.39% | 99.51% | 2.46s | 11.1s | 40 tps | 1.0M | $0.240 / $0.960 | |
| Healthy | 97.18% | 99.05% | 98.55% | 99.06% | 1.69s | 10.1s | 48 tps | 1.0M | $0.300 / $1.20 | |
Maramara | No data | — | 95.28% | 95.06% | 92.30% | 1.19s | 7.47s | 144 tps | 1.0M | $0.600 / $2.40 |
| No data | — | 97.86% | 98.33% | 99.00% | 444ms◆ (best) | 4.97s | 145 tps | 1.0M | $0.750 / $3.00 | |
| No data | — | — | — | — | — | — | — | 256K | $0.255 / $1.02 | |
SambaNovasambanova | No data | — | 94.92% | 96.43% | 97.18% | 3.41s | 10.5s | 45 tps | 1.0M | $0.600 / $2.40 |
- AtlasCloud100%◆ (best)Healthy24h 96.90%
- 7d
- 99.01%
- 30d
- 90.52%
- p50
- 1.17s
- p99
- 9.87s
- Throughput
- 63 tps
- Context
- 524K
- $/Mtok
- $0.300 / $1.20
atlas-cloud/fp8fp8 - DeepInfra100%◆ (best)Healthy24h 99.84%
- 7d
- 99.75%◆ (best)
- 30d
- 98.90%
- p50
- 1.10s
- p99
- 8.08s
- Throughput
- 35 tps
- Context
- 524K
- $/Mtok
- $0.280 / $1.10
deepinfra/fp8fp8 - Novita100%◆ (best)Healthy24h 99.65%
- 7d
- 99.51%
- 30d
- 99.63%◆ (best)
- p50
- 2.12s
- p99
- 15.0s
- Throughput
- 57 tps
- Context
- 1.0M
- $/Mtok
- $0.300 / $1.20
novita/fp8fp8 - Parasail100%◆ (best)Healthy24h 99.81%
- 7d
- 99.58%
- 30d
- 98.44%
- p50
- 606ms
- p99
- 2.38s◆ (best)
- Throughput
- 169 tps◆ (best)
- Context
- 1.0M
- $/Mtok
- $0.300 / $1.20
parasail/fp8fp8 - Together100%◆ (best)Healthy24h 99.45%
- 7d
- 99.51%
- 30d
- 99.54%
- p50
- 1.36s
- p99
- 9.09s
- Throughput
- 21 tps
- Context
- 524K
- $/Mtok
- $0.300 / $1.20
together - Venice100%◆ (best)Healthy24h 94.19%
- 7d
- 96.50%
- 30d
- 95.09%
- p50
- 1.05s
- p99
- 10.0s
- Throughput
- 75 tps
- Context
- 524K
- $/Mtok
- $0.300 / $1.20
venice/fp8fp8 - CoreWeave99.79%Healthy24h 97.02%
- 7d
- 97.41%
- 30d
- 98.81%
- p50
- 632ms
- p99
- 8.30s
- Throughput
- 55 tps
- Context
- 262K
- $/Mtok
- $0.230 / $0.960◆ (best)
coreweave/fp4fp4 - Minimax99.79%Healthy24h 99.74%
- 7d
- 99.62%
- 30d
- 99.34%
- p50
- 1.32s
- p99
- 13.0s
- Throughput
- 64 tps
- Context
- 524K
- $/Mtok
- $0.300 / $1.20
minimax/fp8fp8 - GMICloud98.44%Healthy24h 99.40%
- 7d
- 99.39%
- 30d
- 99.51%
- p50
- 2.46s
- p99
- 11.1s
- Throughput
- 40 tps
- Context
- 1.0M
- $/Mtok
- $0.240 / $0.960
gmicloud/fp8fp8 - StreamLake97.18%Healthy24h 99.05%
- 7d
- 98.55%
- 30d
- 99.06%
- p50
- 1.69s
- p99
- 10.1s
- Throughput
- 48 tps
- Context
- 1.0M
- $/Mtok
- $0.300 / $1.20
streamlake/fp8fp8 - Mara—No data24h 95.28%
- 7d
- 95.06%
- 30d
- 92.30%
- p50
- 1.19s
- p99
- 7.47s
- Throughput
- 144 tps
- Context
- 1.0M
- $/Mtok
- $0.600 / $2.40
mara - No data24h 97.86%
- 7d
- 98.33%
- 30d
- 99.00%
- p50
- 444ms◆ (best)
- p99
- 4.97s
- Throughput
- 145 tps
- Context
- 1.0M
- $/Mtok
- $0.750 / $3.00
modelrun/fp4fp4 - No data24h —
- 7d
- —
- 30d
- —
- p50
- —
- p99
- —
- Throughput
- —
- Context
- 256K
- $/Mtok
- $0.255 / $1.02
morph/fp4fp4 - No data24h 94.92%
- 7d
- 96.43%
- 30d
- 97.18%
- p50
- 3.41s
- p99
- 10.5s
- Throughput
- 45 tps
- Context
- 1.0M
- $/Mtok
- $0.600 / $2.40
sambanova
Measured 1m ago. Latency and throughput are OpenRouter's rolling 30-minute windows. ◆ marks the best value in each column among these endpoints.
Price vs latency
One dot per endpoint at the latest round · further left = faster, lower = cheaper · hover a dot for its tag
History
Availability
Axis starts at 90% so small differences stay visible; it expands to 0 when an endpoint falls below.
Time to first token
Logarithmic axis — the fleet spans two orders of magnitude. P50 is OpenRouter's rolling 30-minute window, averaged over the hour.
Throughput
Median tokens per second.