InferenceBench
Europe
Providers
Models
Research
Partners
Data
Methodology
Search
/
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0011 to 0.012
5m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.60 to 1.28
5m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.012
5m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
5m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
5m
NEW MODEL
nvidia/switchyard appeared in the catalogue
5m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.60
36m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.013
36m
PRICE
nvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok decreased from 0.12 to 0.10
36m
PRICE
nvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.20
36m
PRICE
nvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.50
36m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
36m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
36m
PRICE
~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.29
1h
PRICE
~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.36
1h
PRICE
~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.00
1h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.95 to 1.04
1h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.0038
1h
PRICE
inclusionai/ling-3.0-flash-fin cached_input_per_mtok decreased from 0.012 to 0.0084
1h
PRICE
inclusionai/ling-3.0-flash-fin output_per_mtok decreased from 0.18 to 0.12
1h
PRICE
inclusionai/ling-3.0-flash-fin input_per_mtok decreased from 0.06 to 0.042
1h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.0051
1h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.0051
1h
PRICE
~z-ai/glm-flash-latest output_per_mtok increased from 0.60 to 0.93
2h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.20 to 0.95
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0058
2h
PRICE
z-ai/glm-5.2 cached_input_per_mtok decreased from 0.32 to 0.26
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0077
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0077
2h
PRICE
~moonshotai/kimi-latest input_per_mtok increased from 1.34 to 1.39
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0038 to 0.0011
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.0086
2h
PRICE
google/gemma-4-26b-a4b-it cached_input_per_mtok decreased from 0.05 to 0.038
2h
PRICE
google/gemma-4-26b-a4b-it output_per_mtok decreased from 0.30 to 0.23
2h
PRICE
google/gemma-4-26b-a4b-it input_per_mtok decreased from 0.09 to 0.068
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
~z-ai/glm-flash-latest output_per_mtok decreased from 0.90 to 0.60
3h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0058 to 0.0038
3h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.47 to 1.20
3h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0011 to 0.012
5m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.60 to 1.28
5m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.012
5m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
5m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
5m
NEW MODEL
nvidia/switchyard appeared in the catalogue
5m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.60
36m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.013
36m
PRICE
nvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok decreased from 0.12 to 0.10
36m
PRICE
nvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.20
36m
PRICE
nvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.50
36m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
36m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
36m
PRICE
~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.29
1h
PRICE
~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.36
1h
PRICE
~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.00
1h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.95 to 1.04
1h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.0038
1h
PRICE
inclusionai/ling-3.0-flash-fin cached_input_per_mtok decreased from 0.012 to 0.0084
1h
PRICE
inclusionai/ling-3.0-flash-fin output_per_mtok decreased from 0.18 to 0.12
1h
PRICE
inclusionai/ling-3.0-flash-fin input_per_mtok decreased from 0.06 to 0.042
1h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.0051
1h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.0051
1h
PRICE
~z-ai/glm-flash-latest output_per_mtok increased from 0.60 to 0.93
2h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.20 to 0.95
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0058
2h
PRICE
z-ai/glm-5.2 cached_input_per_mtok decreased from 0.32 to 0.26
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0077
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0077
2h
PRICE
~moonshotai/kimi-latest input_per_mtok increased from 1.34 to 1.39
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0038 to 0.0011
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.0086
2h
PRICE
google/gemma-4-26b-a4b-it cached_input_per_mtok decreased from 0.05 to 0.038
2h
PRICE
google/gemma-4-26b-a4b-it output_per_mtok decreased from 0.30 to 0.23
2h
PRICE
google/gemma-4-26b-a4b-it input_per_mtok decreased from 0.09 to 0.068
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
~z-ai/glm-flash-latest output_per_mtok decreased from 0.90 to 0.60
3h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0058 to 0.0038
3h
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.47 to 1.20
3h
GPT-OSS 120B
on
Groq
#1 of 6 providers for GPT-OSS 120B · #2 of 2 models on Groq · US
BEST FOR GPT-OSS 120B
Compare with other providers
Score
99.7
Rel.
100.0%
Tools
100.0%
JSON
100.0%
TTFT
264 ms
P95
402 ms
Tok/s
486
Price
$0.15 / $0.60
Ctx
128k
217 results · last 896m ago
GPT-OSS 120B on other providers
Provider
Score
TTFT
Tok/s
$ Out
Groq
THIS PAGE
99.7
264 ms
486
$0.60
Cerebras
99.5
184 ms
1749
$0.75
Cortecs
99.4
240 ms
358
$0.46
Scaleway
94.4
179 ms
96
$0.69
OpenRouter
88.8
474 ms
68
$0.17
Together
72.5
182 ms
138
$0.60
Other models on Groq
Model
Score
TTFT
$ Out
GPT-OSS 20B
94.4
258 ms
$0.30
GPT-OSS 120B
THIS PAGE
91.3
264 ms
$0.60