InferenceBench
Europe
Providers
Models
Research
Partners
Data
Methodology
Search
/
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.012 to 0.0077
8m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.012 to 0.0077
8m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0077
8m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0077
8m
PRICE
deepseek/deepseek-v3.1-terminus input_per_mtok decreased from 0.30 to 0.27
8m
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0011 to 0.012
38m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.60 to 1.28
38m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.012
38m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
38m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
38m
NEW MODEL
nvidia/switchyard appeared in the catalogue
38m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.60
1h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.013
1h
PRICE
nvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok decreased from 0.12 to 0.10
1h
PRICE
nvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.20
1h
PRICE
nvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.50
1h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
1h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
1h
PRICE
~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.29
2h
PRICE
~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.36
2h
PRICE
~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.00
2h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.95 to 1.04
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.0038
2h
PRICE
inclusionai/ling-3.0-flash-fin cached_input_per_mtok decreased from 0.012 to 0.0084
2h
PRICE
inclusionai/ling-3.0-flash-fin output_per_mtok decreased from 0.18 to 0.12
2h
PRICE
inclusionai/ling-3.0-flash-fin input_per_mtok decreased from 0.06 to 0.042
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.0051
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.0051
2h
PRICE
~z-ai/glm-flash-latest output_per_mtok increased from 0.60 to 0.93
2h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.20 to 0.95
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0058
2h
PRICE
z-ai/glm-5.2 cached_input_per_mtok decreased from 0.32 to 0.26
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0077
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0077
2h
PRICE
~moonshotai/kimi-latest input_per_mtok increased from 1.34 to 1.39
3h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0038 to 0.0011
3h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.0086
3h
PRICE
google/gemma-4-26b-a4b-it cached_input_per_mtok decreased from 0.05 to 0.038
3h
PRICE
google/gemma-4-26b-a4b-it output_per_mtok decreased from 0.30 to 0.23
3h
PRICE
google/gemma-4-26b-a4b-it input_per_mtok decreased from 0.09 to 0.068
3h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.012 to 0.0077
8m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.012 to 0.0077
8m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0077
8m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0077
8m
PRICE
deepseek/deepseek-v3.1-terminus input_per_mtok decreased from 0.30 to 0.27
8m
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0011 to 0.012
38m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.60 to 1.28
38m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.012
38m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
38m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
38m
NEW MODEL
nvidia/switchyard appeared in the catalogue
38m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.60
1h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.013
1h
PRICE
nvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok decreased from 0.12 to 0.10
1h
PRICE
nvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.20
1h
PRICE
nvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.50
1h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
1h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
1h
PRICE
~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.29
2h
PRICE
~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.36
2h
PRICE
~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.00
2h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.95 to 1.04
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.0038
2h
PRICE
inclusionai/ling-3.0-flash-fin cached_input_per_mtok decreased from 0.012 to 0.0084
2h
PRICE
inclusionai/ling-3.0-flash-fin output_per_mtok decreased from 0.18 to 0.12
2h
PRICE
inclusionai/ling-3.0-flash-fin input_per_mtok decreased from 0.06 to 0.042
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.0051
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.0051
2h
PRICE
~z-ai/glm-flash-latest output_per_mtok increased from 0.60 to 0.93
2h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.20 to 0.95
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0058
2h
PRICE
z-ai/glm-5.2 cached_input_per_mtok decreased from 0.32 to 0.26
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0077
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0077
2h
PRICE
~moonshotai/kimi-latest input_per_mtok increased from 1.34 to 1.39
3h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0038 to 0.0011
3h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.0086
3h
PRICE
google/gemma-4-26b-a4b-it cached_input_per_mtok decreased from 0.05 to 0.038
3h
PRICE
google/gemma-4-26b-a4b-it output_per_mtok decreased from 0.30 to 0.23
3h
PRICE
google/gemma-4-26b-a4b-it input_per_mtok decreased from 0.09 to 0.068
3h
DeepSeek V4 Pro
on
OpenRouter
#2 of 2 providers for DeepSeek V4 Pro · #8 of 13 models on OpenRouter · US · EU
Compare with other providers
Score
88.2
Rel.
100.0%
Tools
100.0%
JSON
97.6%
TTFT
1086 ms
P95
3466 ms
Tok/s
63
Price
$0.21 / $0.42
Ctx
1M
217 results · last 744m ago
DeepSeek V4 Pro on other providers
Provider
Score
TTFT
Tok/s
$ Out
Cortecs
90.6
480 ms
140
$3.50
OpenRouter
THIS PAGE
88.2
1086 ms
63
$0.42
Other models on OpenRouter
Model
Score
TTFT
$ Out
GPT-OSS 120B
93.3
474 ms
$0.17
GPT-OSS 20B
92.3
656 ms
$0.09
Llama 3.3 70B
89.4
576 ms
$0.32
Qwen3-235B
86.2
766 ms
$0.35
DeepSeek V4 Flash
85.9
1059 ms
$0.056
Mistral Large 3
81.5
406 ms
$1.50
Mistral Medium 3.5
80.3
261 ms
$7.50
DeepSeek V4 Pro
THIS PAGE
80.2
1086 ms
$0.42
GLM-5.3
79.8
412 ms
$4.40
MiniMax M3
77.8
929 ms
$1.20
GLM-5.2
73.8
480 ms
$3.99
Kimi K3
72.0
674 ms
$13.50
GLM-4.7
59.9
2259 ms
$2.20