InferenceBench
Europe
Providers
Models
Research
Partners
Data
Methodology
Search
/
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.60
6m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.013
6m
PRICE
nvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok decreased from 0.12 to 0.10
6m
PRICE
nvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.20
6m
PRICE
nvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.50
6m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
6m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
6m
PRICE
~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.29
37m
PRICE
~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.36
37m
PRICE
~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.00
37m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.95 to 1.04
37m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.0038
37m
PRICE
inclusionai/ling-3.0-flash-fin cached_input_per_mtok decreased from 0.012 to 0.0084
37m
PRICE
inclusionai/ling-3.0-flash-fin output_per_mtok decreased from 0.18 to 0.12
37m
PRICE
inclusionai/ling-3.0-flash-fin input_per_mtok decreased from 0.06 to 0.042
37m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.0051
37m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.0051
37m
PRICE
~z-ai/glm-flash-latest output_per_mtok increased from 0.60 to 0.93
1h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.20 to 0.95
1h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0058
1h
PRICE
z-ai/glm-5.2 cached_input_per_mtok decreased from 0.32 to 0.26
1h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0077
1h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0077
1h
PRICE
~moonshotai/kimi-latest input_per_mtok increased from 1.34 to 1.39
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0038 to 0.0011
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.0086
2h
PRICE
google/gemma-4-26b-a4b-it cached_input_per_mtok decreased from 0.05 to 0.038
2h
PRICE
google/gemma-4-26b-a4b-it output_per_mtok decreased from 0.30 to 0.23
2h
PRICE
google/gemma-4-26b-a4b-it input_per_mtok decreased from 0.09 to 0.068
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
~z-ai/glm-flash-latest output_per_mtok decreased from 0.90 to 0.60
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0058 to 0.0038
2h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.47 to 1.20
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.0038
2h
PRICE
z-ai/glm-5.2 cached_input_per_mtok increased from 0.26 to 0.32
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0077 to 0.017
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0077 to 0.017
2h
PRICE
~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.80
3h
PRICE
~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.00
3h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.60
6m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.013
6m
PRICE
nvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok decreased from 0.12 to 0.10
6m
PRICE
nvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.20
6m
PRICE
nvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.50
6m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
6m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
6m
PRICE
~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.29
37m
PRICE
~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.36
37m
PRICE
~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.00
37m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.95 to 1.04
37m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.0038
37m
PRICE
inclusionai/ling-3.0-flash-fin cached_input_per_mtok decreased from 0.012 to 0.0084
37m
PRICE
inclusionai/ling-3.0-flash-fin output_per_mtok decreased from 0.18 to 0.12
37m
PRICE
inclusionai/ling-3.0-flash-fin input_per_mtok decreased from 0.06 to 0.042
37m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.0051
37m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.0051
37m
PRICE
~z-ai/glm-flash-latest output_per_mtok increased from 0.60 to 0.93
1h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.20 to 0.95
1h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0058
1h
PRICE
z-ai/glm-5.2 cached_input_per_mtok decreased from 0.32 to 0.26
1h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0077
1h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0077
1h
PRICE
~moonshotai/kimi-latest input_per_mtok increased from 1.34 to 1.39
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0038 to 0.0011
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.0086
2h
PRICE
google/gemma-4-26b-a4b-it cached_input_per_mtok decreased from 0.05 to 0.038
2h
PRICE
google/gemma-4-26b-a4b-it output_per_mtok decreased from 0.30 to 0.23
2h
PRICE
google/gemma-4-26b-a4b-it input_per_mtok decreased from 0.09 to 0.068
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
~z-ai/glm-flash-latest output_per_mtok decreased from 0.90 to 0.60
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0058 to 0.0038
2h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.47 to 1.20
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.0038
2h
PRICE
z-ai/glm-5.2 cached_input_per_mtok increased from 0.26 to 0.32
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0077 to 0.017
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0077 to 0.017
2h
PRICE
~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.80
3h
PRICE
~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.00
3h
Kimi K3
on
Cortecs
#1 of 3 providers for Kimi K3 · #11 of 11 models on Cortecs · EU
BEST FOR KIMI K3
Compare with other providers
Score
88.0
Rel.
100.0%
Tools
100.0%
JSON
100.0%
TTFT
624 ms
P95
1566 ms
Tok/s
171
Price
$3.09 / $15.43
Ctx
1M
217 results · last 531m ago
Kimi K3 on other providers
Provider
Score
TTFT
Tok/s
$ Out
Cortecs
THIS PAGE
88.0
624 ms
171
$15.43
Together
82.6
602 ms
104
$13.50
OpenRouter
76.2
674 ms
90
$13.50
Other models on Cortecs
Model
Score
TTFT
$ Out
GPT-OSS 20B
97.5
175 ms
$0.17
DeepSeek V4 Flash
94.4
411 ms
$0.18
GPT-OSS 120B
92.8
240 ms
$0.46
Llama 3.3 70B
87.7
441 ms
$0.75
MiniMax M3
84.4
517 ms
$1.23
Qwen3-235B
82.2
937 ms
$0.47
GLM-5.2
81.4
425 ms
$3.33
Mistral Large 3
81.2
413 ms
$1.89
Mistral Medium 3.5
79.9
261 ms
$8.07
DeepSeek V4 Pro
79.5
480 ms
$3.50
Kimi K3
THIS PAGE
73.7
624 ms
$15.43
1 more model declared in Cortecs's catalogue — not yet measured from the canonical vantage.