InferenceBench
Europe
Providers
Models
Research
Partners
Data
Methodology
Search
/
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.0077
10m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.60 to 1.28
10m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0077
10m
PRICE
~deepseek/deepseek-flash-latest cached_input_per_mtok increased from 0.0021 to 0.006
10m
PRICE
~deepseek/deepseek-flash-latest output_per_mtok decreased from 1.20 to 0.42
10m
PRICE
~deepseek/deepseek-flash-latest input_per_mtok increased from 0.015 to 0.02
10m
PRICE
deepseek/deepseek-v4.1-flash output_per_mtok decreased from 1.20 to 0.42
10m
PRICE
deepseek/deepseek-v4.1-flash input_per_mtok decreased from 0.30 to 0.02
10m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.0077
10m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.0077
10m
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0051 to 0.013
41m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
41m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
41m
PRICE
nvidia/nemotron-3-ultra-550b-a55b input_per_mtok increased from 0.50 to 0.60
41m
PRICE
nvidia/nemotron-3-ultra-550b-a55b output_per_mtok increased from 2.20 to 2.40
41m
PRICE
nvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok increased from 0.10 to 0.12
41m
PRICE
tencent/hy3 input_per_mtok decreased from 0.13 to 0.083
41m
PRICE
tencent/hy3 output_per_mtok decreased from 0.53 to 0.33
41m
PRICE
tencent/hy3 cached_input_per_mtok decreased from 0.033 to 0.021
41m
PRICE
tencent/hy4-preview input_per_mtok decreased from 0.83 to 0.75
41m
PRICE
tencent/hy4-preview output_per_mtok decreased from 2.50 to 2.25
41m
PRICE
tencent/hy4-preview cached_input_per_mtok decreased from 0.042 to 0.038
41m
PRICE
z-ai/glm-5.3-flash input_per_mtok decreased from 0.15 to 0.026
41m
PRICE
z-ai/glm-5.3-flash output_per_mtok increased from 0.50 to 0.90
41m
PRICE
z-ai/glm-5.3-flash cached_input_per_mtok decreased from 0.03 to 0.011
41m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0051 to 0.013
41m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 1.28 to 1.60
41m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0051
1h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0051
1h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0051
1h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.60 to 1.28
1h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0086 to 0.0051
1h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0086
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.0086
2h
NEW MODEL
inclusionai/ling-3.1-flash appeared in the catalogue
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.013
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.0077
10m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.60 to 1.28
10m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0077
10m
PRICE
~deepseek/deepseek-flash-latest cached_input_per_mtok increased from 0.0021 to 0.006
10m
PRICE
~deepseek/deepseek-flash-latest output_per_mtok decreased from 1.20 to 0.42
10m
PRICE
~deepseek/deepseek-flash-latest input_per_mtok increased from 0.015 to 0.02
10m
PRICE
deepseek/deepseek-v4.1-flash output_per_mtok decreased from 1.20 to 0.42
10m
PRICE
deepseek/deepseek-v4.1-flash input_per_mtok decreased from 0.30 to 0.02
10m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.0077
10m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.0077
10m
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0051 to 0.013
41m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
41m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
41m
PRICE
nvidia/nemotron-3-ultra-550b-a55b input_per_mtok increased from 0.50 to 0.60
41m
PRICE
nvidia/nemotron-3-ultra-550b-a55b output_per_mtok increased from 2.20 to 2.40
41m
PRICE
nvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok increased from 0.10 to 0.12
41m
PRICE
tencent/hy3 input_per_mtok decreased from 0.13 to 0.083
41m
PRICE
tencent/hy3 output_per_mtok decreased from 0.53 to 0.33
41m
PRICE
tencent/hy3 cached_input_per_mtok decreased from 0.033 to 0.021
41m
PRICE
tencent/hy4-preview input_per_mtok decreased from 0.83 to 0.75
41m
PRICE
tencent/hy4-preview output_per_mtok decreased from 2.50 to 2.25
41m
PRICE
tencent/hy4-preview cached_input_per_mtok decreased from 0.042 to 0.038
41m
PRICE
z-ai/glm-5.3-flash input_per_mtok decreased from 0.15 to 0.026
41m
PRICE
z-ai/glm-5.3-flash output_per_mtok increased from 0.50 to 0.90
41m
PRICE
z-ai/glm-5.3-flash cached_input_per_mtok decreased from 0.03 to 0.011
41m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0051 to 0.013
41m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 1.28 to 1.60
41m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0051
1h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0051
1h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0051
1h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.60 to 1.28
1h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0086 to 0.0051
1h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0086
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.0086
2h
NEW MODEL
inclusionai/ling-3.1-flash appeared in the catalogue
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.013
2h
GLM-4.7
on
OpenRouter
#1 of 1 providers for GLM-4.7 · #13 of 13 models on OpenRouter · US · EU
Compare with other providers
Score
86.5
Rel.
100.0%
Tools
100.0%
JSON
100.0%
TTFT
2259 ms
P95
9785 ms
Tok/s
40
Price
$0.60 / $2.20
Ctx
200k
217 results · last 437m ago
GLM-4.7 on other providers
Provider
Score
TTFT
Tok/s
$ Out
OpenRouter
THIS PAGE
86.5
2259 ms
40
$2.20
Other models on OpenRouter
Model
Score
TTFT
$ Out
GPT-OSS 120B
93.3
474 ms
$0.17
GPT-OSS 20B
92.3
656 ms
$0.09
Llama 3.3 70B
89.4
576 ms
$0.32
Qwen3-235B
86.2
766 ms
$0.35
DeepSeek V4 Flash
85.9
1059 ms
$0.056
Mistral Large 3
81.5
406 ms
$1.50
Mistral Medium 3.5
80.3
261 ms
$7.50
DeepSeek V4 Pro
80.2
1086 ms
$0.42
GLM-5.3
79.8
412 ms
$4.40
MiniMax M3
77.8
929 ms
$1.20
GLM-5.2
73.8
480 ms
$3.99
Kimi K3
72.0
674 ms
$13.50
GLM-4.7
THIS PAGE
59.9
2259 ms
$2.20