InferenceBench
Europe
Providers
Models
Research
Partners
Data
Methodology
Search
/
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.0086
28m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0086
28m
CAPABILITY
xiaomi/mimo-v2.6-flash now declares support for top_logprobs
28m
CAPABILITY
xiaomi/mimo-v2.6-flash now declares support for logprobs
28m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
28m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
28m
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0058 to 0.013
59m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0058 to 0.013
59m
CAPABILITY
openai/gpt-5.4-image-2 no longer declares support for stop
59m
CAPABILITY
openai/gpt-5.4-image-2 no longer declares support for presence_penalty
59m
CAPABILITY
openai/gpt-5.4-image-2 no longer declares support for logit_bias
59m
CAPABILITY
openai/gpt-5.4-image-2 no longer declares support for frequency_penalty
59m
CAPABILITY
openai/gpt-5-image-mini no longer declares support for stop
59m
CAPABILITY
openai/gpt-5-image-mini no longer declares support for presence_penalty
59m
CAPABILITY
openai/gpt-5-image-mini no longer declares support for logit_bias
59m
CAPABILITY
openai/gpt-5-image-mini no longer declares support for frequency_penalty
59m
CAPABILITY
openai/gpt-5-image no longer declares support for stop
59m
CAPABILITY
openai/gpt-5-image no longer declares support for presence_penalty
59m
CAPABILITY
openai/gpt-5-image no longer declares support for logit_bias
59m
CAPABILITY
openai/gpt-5-image no longer declares support for frequency_penalty
59m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0077 to 0.017
59m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0077 to 0.017
59m
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0086 to 0.0058
1h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0058
1h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0077
1h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0077
1h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.0086
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0086
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0038 to 0.013
3h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.013
3h
PRICE
~deepseek/deepseek-flash-latest cached_input_per_mtok increased from 0.002 to 0.0021
3h
PRICE
~deepseek/deepseek-flash-latest input_per_mtok increased from 0.002 to 0.015
3h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
3h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
3h
PRICE
~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.80
3h
PRICE
~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.00
3h
PRICE
~moonshotai/kimi-latest input_per_mtok increased from 0.35 to 1.39
3h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0058 to 0.0038
3h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.0086
28m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0086
28m
CAPABILITY
xiaomi/mimo-v2.6-flash now declares support for top_logprobs
28m
CAPABILITY
xiaomi/mimo-v2.6-flash now declares support for logprobs
28m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
28m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
28m
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0058 to 0.013
59m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0058 to 0.013
59m
CAPABILITY
openai/gpt-5.4-image-2 no longer declares support for stop
59m
CAPABILITY
openai/gpt-5.4-image-2 no longer declares support for presence_penalty
59m
CAPABILITY
openai/gpt-5.4-image-2 no longer declares support for logit_bias
59m
CAPABILITY
openai/gpt-5.4-image-2 no longer declares support for frequency_penalty
59m
CAPABILITY
openai/gpt-5-image-mini no longer declares support for stop
59m
CAPABILITY
openai/gpt-5-image-mini no longer declares support for presence_penalty
59m
CAPABILITY
openai/gpt-5-image-mini no longer declares support for logit_bias
59m
CAPABILITY
openai/gpt-5-image-mini no longer declares support for frequency_penalty
59m
CAPABILITY
openai/gpt-5-image no longer declares support for stop
59m
CAPABILITY
openai/gpt-5-image no longer declares support for presence_penalty
59m
CAPABILITY
openai/gpt-5-image no longer declares support for logit_bias
59m
CAPABILITY
openai/gpt-5-image no longer declares support for frequency_penalty
59m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0077 to 0.017
59m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0077 to 0.017
59m
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0086 to 0.0058
1h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0058
1h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0077
1h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0077
1h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.0086
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0086
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0038 to 0.013
3h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.013
3h
PRICE
~deepseek/deepseek-flash-latest cached_input_per_mtok increased from 0.002 to 0.0021
3h
PRICE
~deepseek/deepseek-flash-latest input_per_mtok increased from 0.002 to 0.015
3h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
3h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
3h
PRICE
~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.80
3h
PRICE
~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.00
3h
PRICE
~moonshotai/kimi-latest input_per_mtok increased from 0.35 to 1.39
3h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0058 to 0.0038
3h
GPT-OSS 120B
on
OpenRouter
#5 of 6 providers for GPT-OSS 120B · #1 of 13 models on OpenRouter · US · EU
Compare with other providers
Score
88.8
Rel.
99.1%
Tools
100.0%
JSON
100.0%
TTFT
474 ms
P95
1413 ms
Tok/s
68
Price
$0.037 / $0.17
Ctx
128k
217 results · last 269m ago
GPT-OSS 120B on other providers
Provider
Score
TTFT
Tok/s
$ Out
Groq
99.7
264 ms
486
$0.60
Cerebras
99.5
184 ms
1749
$0.75
Cortecs
99.4
240 ms
358
$0.46
Scaleway
94.4
179 ms
96
$0.69
OpenRouter
THIS PAGE
88.8
474 ms
68
$0.17
Together
72.5
182 ms
138
$0.60
Other models on OpenRouter
Model
Score
TTFT
$ Out
GPT-OSS 120B
THIS PAGE
93.3
474 ms
$0.17
GPT-OSS 20B
92.3
656 ms
$0.09
Llama 3.3 70B
89.4
576 ms
$0.32
Qwen3-235B
86.2
766 ms
$0.35
DeepSeek V4 Flash
85.9
1059 ms
$0.084
Mistral Large 3
81.5
406 ms
$1.50
Mistral Medium 3.5
80.3
261 ms
$7.50
DeepSeek V4 Pro
80.2
1086 ms
$0.42
GLM-5.3
79.8
412 ms
$4.40
MiniMax M3
77.8
929 ms
$1.20
GLM-5.2
73.8
480 ms
$3.99
Kimi K3
72.0
674 ms
$13.50
GLM-4.7
59.9
2259 ms
$2.20