modelstatus.dev

Kimi K2.7 Code

Kimi K2.7 Code: providers compared

Every endpoint serving this model, side by side. ◆ marks the best value in each column — per model, never fleet-wide.

  • CoreWeave100% (best)
    Healthy24h 99.96%
    7d
    99.92%
    30d
    99.92%
    p50
    877ms
    p99
    12.2s
    Throughput
    120 tps
    Context
    262K
    $/Mtok
    $0.710 / $3.50
    coreweave/int4int4
  • Inceptron100% (best)
    Healthy24h 99.82%
    7d
    99.82%
    30d
    99.82%
    p50
    817ms
    p99
    85.3s
    Throughput
    65 tps
    Context
    262K
    $/Mtok
    $0.670 / $3.40 (best)
    inceptron/int4int4
  • No data24h 99.79%
    7d
    100% (best)
    30d
    100% (best)
    p50
    3.75s
    p99
    8.12s
    Throughput
    29 tps
    Context
    262K
    $/Mtok
    $0.950 / $4.00
    alibaba/fp8fp8
  • No data24h 99.73%
    7d
    100% (best)
    30d
    100% (best)
    p50
    821ms
    p99
    2.47s (best)
    Throughput
    98 tps
    Context
    262K
    $/Mtok
    $0.690 / $3.49
    ambient
  • No data24h
    7d
    100% (best)
    30d
    100% (best)
    p50
    p99
    Throughput
    Context
    262K
    $/Mtok
    $0.950 / $4.00
    atlas-cloud/int4int4
  • No data24h 100%
    7d
    100% (best)
    30d
    100% (best)
    p50
    920ms
    p99
    7.72s
    Throughput
    47 tps
    Context
    262K
    $/Mtok
    $0.950 / $4.00
    cloudflare
  • No data24h 99.95%
    7d
    99.48%
    30d
    99.48%
    p50
    720ms
    p99
    8.49s
    Throughput
    32 tps
    Context
    262K
    $/Mtok
    $0.680 / $3.40
    deepinfra/fp4fp4
  • No data24h 96.29%
    7d
    30d
    p50
    3.35s
    p99
    33.0s
    Throughput
    36 tps
    Context
    262K
    $/Mtok
    $0.950 / $4.00
    gmicloud/fp8fp8
  • Down24h 45.99%
    7d
    83.84%
    30d
    83.84%
    p50
    386ms (best)
    p99
    15.9s
    Throughput
    182 tps (best)
    Context
    262K
    $/Mtok
    $0.850 / $3.75
    modelrun/fp4fp4
  • No data24h 99.85%
    7d
    99.91%
    30d
    99.91%
    p50
    2.14s
    p99
    7.07s
    Throughput
    92 tps
    Context
    262K
    $/Mtok
    $1.90 / $8.00
    moonshotai/highspeedint4
  • No data24h 99.92%
    7d
    99.71%
    30d
    99.71%
    p50
    1.47s
    p99
    35.9s
    Throughput
    52 tps
    Context
    262K
    $/Mtok
    $0.950 / $4.00
    moonshotai/int4int4
  • No data24h 99.80%
    7d
    99.22%
    30d
    99.22%
    p50
    1.68s
    p99
    25.4s
    Throughput
    36 tps
    Context
    262K
    $/Mtok
    $0.912 / $3.84
    novita/int4int4
  • No data24h 99.12%
    7d
    99.31%
    30d
    99.31%
    p50
    776ms
    p99
    7.50s
    Throughput
    65 tps
    Context
    262K
    $/Mtok
    $0.760 / $3.50
    parasail/int4int4
  • No data24h 99.94%
    7d
    99.98%
    30d
    99.98%
    p50
    1.60s
    p99
    6.55s
    Throughput
    43 tps
    Context
    262K
    $/Mtok
    $0.859 / $3.80
    siliconflow/fp8fp8
  • Down24h 18.32%
    7d
    78.83%
    30d
    78.83%
    p50
    708ms
    p99
    10.7s
    Throughput
    177 tps
    Context
    262K
    $/Mtok
    $0.950 / $4.00
    together
  • No data24h 97.64%
    7d
    97.52%
    30d
    97.52%
    p50
    1.06s
    p99
    4.57s
    Throughput
    32 tps
    Context
    256K
    $/Mtok
    $0.750 / $3.50
    venice/int4int4

Measured 2m ago. Latency and throughput are OpenRouter's rolling 30-minute windows. ◆ marks the best value in each column among these endpoints.

Price vs latency

One dot per endpoint at the latest round · further left = faster, lower = cheaper · hover a dot for its tag

History

Availability

Axis starts at 90% so small differences stay visible; it expands to 0 when an endpoint falls below.

Time to first token

Logarithmic axis — the fleet spans two orders of magnitude. P50 is OpenRouter's rolling 30-minute window.

Throughput

Median tokens per second.