InferenceBench
Europe
Providers
Models
Research
Partners
Data
Methodology
Search
/
PRICE
~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.80
23m
PRICE
~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.00
23m
PRICE
~moonshotai/kimi-latest input_per_mtok increased from 0.75 to 0.99
23m
PERFORMANCE
GLM-5.2 → Scaleway: TTFT ↑ 20%
53m
PERFORMANCE
DeepSeek V4 Flash → Scaleway: TTFT ↑ 35%
53m
PERFORMANCE
Mistral Medium 3.5 → Scaleway: TTFT ↓ 21%
53m
PERFORMANCE
DeepSeek V4 Flash → Scaleway: throughput ↓ 20%
53m
PERFORMANCE
GPT-OSS 120B → Scaleway: throughput ↑ 31%
53m
PERFORMANCE
GPT-OSS 120B → Scaleway: TTFT ↓ 24%
53m
PERFORMANCE
GPT-OSS 120B → Together AI: throughput ↑ 20%
53m
PERFORMANCE
Kimi K3 via OpenRouter: TTFT ↓ 49%
53m
PERFORMANCE
GLM-5.2 via OpenRouter: reliability recovered 96.8% → 100.0%
53m
PERFORMANCE
Kimi K3 via Cortecs: throughput ↑ 184%
53m
PERFORMANCE
Kimi K3 via Cortecs: TTFT ↓ 42%
53m
PERFORMANCE
GLM-5.2 via OpenRouter: throughput ↓ 49%
53m
PERFORMANCE
GLM-5.2 via OpenRouter: TTFT ↑ 121%
53m
PERFORMANCE
MiniMax M3 via OpenRouter: reliability recovered 96.8% → 100.0%
53m
PERFORMANCE
DeepSeek V4 Pro via Cortecs: throughput ↑ 27%
53m
PERFORMANCE
GPT-OSS 120B via OpenRouter: throughput ↓ 22%
53m
PERFORMANCE
GLM-4.7 via OpenRouter: TTFT ↓ 78%
53m
PERFORMANCE
GPT-OSS 20B → Groq: TTFT ↑ 24%
53m
PERFORMANCE
Kimi K3 → Together AI: TTFT ↓ 34%
53m
PERFORMANCE
DeepSeek V4 Flash via OpenRouter: throughput ↓ 17%
53m
PERFORMANCE
Llama 3.3 70B via Cortecs: TTFT ↓ 51%
53m
PERFORMANCE
Qwen3 235B via OpenRouter: throughput ↑ 37%
53m
PERFORMANCE
Qwen3 235B via OpenRouter: TTFT ↓ 29%
53m
PERFORMANCE
DeepSeek V4 Flash → Together AI: throughput ↑ 19%
53m
PERFORMANCE
GLM-5.3 via OpenRouter: throughput ↓ 17%
53m
PERFORMANCE
GPT-OSS 20B via Cortecs: throughput ↑ 28%
53m
PERFORMANCE
Llama 3.3 70B → Together AI: TTFT ↓ 33%
53m
PRICE
~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.29
54m
PRICE
~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.36
54m
PRICE
~moonshotai/kimi-latest input_per_mtok decreased from 0.99 to 0.75
54m
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0077 to 0.0011
54m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.28 to 1.04
54m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0077 to 0.0038
54m
PRICE
z-ai/glm-5.1 cached_input_per_mtok increased from 0.18 to 0.26
54m
PRICE
z-ai/glm-5.1 output_per_mtok increased from 3.03 to 4.40
54m
PRICE
z-ai/glm-5.1 input_per_mtok increased from 0.96 to 1.40
54m
PRICE
tencent/hy4-preview cached_input_per_mtok increased from 0.038 to 0.042
54m
PRICE
~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.80
23m
PRICE
~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.00
23m
PRICE
~moonshotai/kimi-latest input_per_mtok increased from 0.75 to 0.99
23m
PERFORMANCE
GLM-5.2 → Scaleway: TTFT ↑ 20%
53m
PERFORMANCE
DeepSeek V4 Flash → Scaleway: TTFT ↑ 35%
53m
PERFORMANCE
Mistral Medium 3.5 → Scaleway: TTFT ↓ 21%
53m
PERFORMANCE
DeepSeek V4 Flash → Scaleway: throughput ↓ 20%
53m
PERFORMANCE
GPT-OSS 120B → Scaleway: throughput ↑ 31%
53m
PERFORMANCE
GPT-OSS 120B → Scaleway: TTFT ↓ 24%
53m
PERFORMANCE
GPT-OSS 120B → Together AI: throughput ↑ 20%
53m
PERFORMANCE
Kimi K3 via OpenRouter: TTFT ↓ 49%
53m
PERFORMANCE
GLM-5.2 via OpenRouter: reliability recovered 96.8% → 100.0%
53m
PERFORMANCE
Kimi K3 via Cortecs: throughput ↑ 184%
53m
PERFORMANCE
Kimi K3 via Cortecs: TTFT ↓ 42%
53m
PERFORMANCE
GLM-5.2 via OpenRouter: throughput ↓ 49%
53m
PERFORMANCE
GLM-5.2 via OpenRouter: TTFT ↑ 121%
53m
PERFORMANCE
MiniMax M3 via OpenRouter: reliability recovered 96.8% → 100.0%
53m
PERFORMANCE
DeepSeek V4 Pro via Cortecs: throughput ↑ 27%
53m
PERFORMANCE
GPT-OSS 120B via OpenRouter: throughput ↓ 22%
53m
PERFORMANCE
GLM-4.7 via OpenRouter: TTFT ↓ 78%
53m
PERFORMANCE
GPT-OSS 20B → Groq: TTFT ↑ 24%
53m
PERFORMANCE
Kimi K3 → Together AI: TTFT ↓ 34%
53m
PERFORMANCE
DeepSeek V4 Flash via OpenRouter: throughput ↓ 17%
53m
PERFORMANCE
Llama 3.3 70B via Cortecs: TTFT ↓ 51%
53m
PERFORMANCE
Qwen3 235B via OpenRouter: throughput ↑ 37%
53m
PERFORMANCE
Qwen3 235B via OpenRouter: TTFT ↓ 29%
53m
PERFORMANCE
DeepSeek V4 Flash → Together AI: throughput ↑ 19%
53m
PERFORMANCE
GLM-5.3 via OpenRouter: throughput ↓ 17%
53m
PERFORMANCE
GPT-OSS 20B via Cortecs: throughput ↑ 28%
53m
PERFORMANCE
Llama 3.3 70B → Together AI: TTFT ↓ 33%
53m
PRICE
~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.29
54m
PRICE
~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.36
54m
PRICE
~moonshotai/kimi-latest input_per_mtok decreased from 0.99 to 0.75
54m
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0077 to 0.0011
54m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.28 to 1.04
54m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0077 to 0.0038
54m
PRICE
z-ai/glm-5.1 cached_input_per_mtok increased from 0.18 to 0.26
54m
PRICE
z-ai/glm-5.1 output_per_mtok increased from 3.03 to 4.40
54m
PRICE
z-ai/glm-5.1 input_per_mtok increased from 0.96 to 1.40
54m
PRICE
tencent/hy4-preview cached_input_per_mtok increased from 0.038 to 0.042
54m
Kimi K3
on
OpenRouter
#3 of 3 providers for Kimi K3 · #12 of 13 models on OpenRouter · US · EU
Compare with other providers
Score
76.2
Rel.
97.2%
Tools
100.0%
JSON
100.0%
TTFT
674 ms
P95
3408 ms
Tok/s
90
Price
$2.70 / $13.50
Ctx
1M
217 results · last 53m ago
Kimi K3 on other providers
Provider
Score
TTFT
Tok/s
$ Out
Cortecs
88.0
624 ms
171
$15.43
Together
82.6
602 ms
104
$13.50
OpenRouter
THIS PAGE
76.2
674 ms
90
$13.50
Other models on OpenRouter
Model
Score
TTFT
$ Out
GPT-OSS 120B
93.3
474 ms
$0.17
GPT-OSS 20B
92.3
656 ms
$0.09
Llama 3.3 70B
89.4
576 ms
$0.32
Qwen3-235B
86.2
766 ms
$0.35
DeepSeek V4 Flash
85.9
1059 ms
$0.056
Mistral Large 3
81.5
406 ms
$1.50
Mistral Medium 3.5
80.4
259 ms
$7.50
DeepSeek V4 Pro
80.2
1086 ms
$0.42
GLM-5.3
79.8
412 ms
$4.40
MiniMax M3
77.8
929 ms
$1.20
GLM-5.2
73.8
480 ms
$3.99
Kimi K3
THIS PAGE
72.0
674 ms
$13.50
GLM-4.7
59.9
2259 ms
$2.20