InferenceBench
Europe
Providers
Models
Research
Partners
Data
Methodology
Search
/
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.0086
16m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0086
16m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
16m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
16m
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0038 to 0.013
47m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.013
47m
PRICE
~deepseek/deepseek-flash-latest cached_input_per_mtok increased from 0.002 to 0.0021
47m
PRICE
~deepseek/deepseek-flash-latest input_per_mtok increased from 0.002 to 0.015
47m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
47m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
47m
PRICE
~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.80
1h
PRICE
~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.00
1h
PRICE
~moonshotai/kimi-latest input_per_mtok increased from 0.35 to 1.39
1h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0058 to 0.0038
1h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.0038
1h
PRICE
~deepseek/deepseek-flash-latest cached_input_per_mtok decreased from 0.004 to 0.002
1h
PRICE
~deepseek/deepseek-flash-latest output_per_mtok increased from 0.60 to 1.20
1h
PRICE
~deepseek/deepseek-flash-latest input_per_mtok decreased from 0.004 to 0.002
1h
PRICE
qwen/qwen3-30b-a3b-instruct-2507 output_per_mtok decreased from 0.30 to 0.19
1h
PRICE
qwen/qwen3-30b-a3b-instruct-2507 input_per_mtok decreased from 0.10 to 0.048
1h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.0051
1h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.0051
1h
PRICE
~z-ai/glm-latest cached_input_per_mtok decreased from 0.18 to 0.08
2h
PRICE
~z-ai/glm-latest output_per_mtok increased from 2.99 to 4.00
2h
PRICE
~z-ai/glm-latest input_per_mtok increased from 0.083 to 0.12
2h
PRICE
~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.29
2h
PRICE
~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.36
2h
PRICE
~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 0.35
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0086 to 0.0058
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0058
2h
PRICE
~deepseek/deepseek-flash-latest cached_input_per_mtok decreased from 0.0061 to 0.004
2h
PRICE
~deepseek/deepseek-flash-latest input_per_mtok decreased from 0.0061 to 0.004
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0077
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0077
2h
PRICE
~z-ai/glm-latest cached_input_per_mtok increased from 0.06 to 0.18
2h
PRICE
~z-ai/glm-latest output_per_mtok decreased from 4.00 to 2.99
2h
PRICE
~z-ai/glm-latest input_per_mtok decreased from 0.12 to 0.083
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.0086
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0086
2h
PRICE
~deepseek/deepseek-flash-latest cached_input_per_mtok decreased from 0.0091 to 0.0061
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.0086
16m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0086
16m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
16m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
16m
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0038 to 0.013
47m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.013
47m
PRICE
~deepseek/deepseek-flash-latest cached_input_per_mtok increased from 0.002 to 0.0021
47m
PRICE
~deepseek/deepseek-flash-latest input_per_mtok increased from 0.002 to 0.015
47m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
47m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
47m
PRICE
~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.80
1h
PRICE
~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.00
1h
PRICE
~moonshotai/kimi-latest input_per_mtok increased from 0.35 to 1.39
1h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0058 to 0.0038
1h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.0038
1h
PRICE
~deepseek/deepseek-flash-latest cached_input_per_mtok decreased from 0.004 to 0.002
1h
PRICE
~deepseek/deepseek-flash-latest output_per_mtok increased from 0.60 to 1.20
1h
PRICE
~deepseek/deepseek-flash-latest input_per_mtok decreased from 0.004 to 0.002
1h
PRICE
qwen/qwen3-30b-a3b-instruct-2507 output_per_mtok decreased from 0.30 to 0.19
1h
PRICE
qwen/qwen3-30b-a3b-instruct-2507 input_per_mtok decreased from 0.10 to 0.048
1h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.0051
1h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.0051
1h
PRICE
~z-ai/glm-latest cached_input_per_mtok decreased from 0.18 to 0.08
2h
PRICE
~z-ai/glm-latest output_per_mtok increased from 2.99 to 4.00
2h
PRICE
~z-ai/glm-latest input_per_mtok increased from 0.083 to 0.12
2h
PRICE
~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.29
2h
PRICE
~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.36
2h
PRICE
~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 0.35
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0086 to 0.0058
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0058
2h
PRICE
~deepseek/deepseek-flash-latest cached_input_per_mtok decreased from 0.0061 to 0.004
2h
PRICE
~deepseek/deepseek-flash-latest input_per_mtok decreased from 0.0061 to 0.004
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0077
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0077
2h
PRICE
~z-ai/glm-latest cached_input_per_mtok increased from 0.06 to 0.18
2h
PRICE
~z-ai/glm-latest output_per_mtok decreased from 4.00 to 2.99
2h
PRICE
~z-ai/glm-latest input_per_mtok decreased from 0.12 to 0.083
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.0086
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0086
2h
PRICE
~deepseek/deepseek-flash-latest cached_input_per_mtok decreased from 0.0091 to 0.0061
2h
GPT-OSS 120B
on
Together
#6 of 6 providers for GPT-OSS 120B · #2 of 6 models on Together · US
Compare with other providers
Score
72.5
Rel.
93.5%
Tools
100.0%
JSON
85.7%
TTFT
182 ms
P95
467 ms
Tok/s
138
Price
$0.15 / $0.60
Ctx
128k
217 results · last 256m ago
GPT-OSS 120B on other providers
Provider
Score
TTFT
Tok/s
$ Out
Groq
99.7
264 ms
486
$0.60
Cerebras
99.5
184 ms
1749
$0.75
Cortecs
99.4
240 ms
358
$0.46
Scaleway
94.4
179 ms
96
$0.69
OpenRouter
88.8
474 ms
68
$0.17
Together
THIS PAGE
72.5
182 ms
138
$0.60
Other models on Together
Model
Score
TTFT
$ Out
DeepSeek V4 Flash
87.4
714 ms
$0.28
GPT-OSS 120B
THIS PAGE
87.2
182 ms
$0.60
MiniMax M3
83.7
542 ms
$1.20
Llama 3.3 70B
83.4
632 ms
$1.04
GLM-5.2
82.5
271 ms
$4.40
Kimi K3
73.4
602 ms
$13.50
4 more models declared in Together's catalogue — not yet measured from the canonical vantage.