InferenceBench
Europe
Providers
Models
Research
Partners
Data
Methodology
Search
/
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0051 to 0.013
19m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
19m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
19m
PRICE
nvidia/nemotron-3-ultra-550b-a55b input_per_mtok increased from 0.50 to 0.60
19m
PRICE
nvidia/nemotron-3-ultra-550b-a55b output_per_mtok increased from 2.20 to 2.40
19m
PRICE
nvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok increased from 0.10 to 0.12
19m
PRICE
tencent/hy3 input_per_mtok decreased from 0.13 to 0.083
19m
PRICE
tencent/hy3 output_per_mtok decreased from 0.53 to 0.33
19m
PRICE
tencent/hy3 cached_input_per_mtok decreased from 0.033 to 0.021
19m
PRICE
tencent/hy4-preview input_per_mtok decreased from 0.83 to 0.75
19m
PRICE
tencent/hy4-preview output_per_mtok decreased from 2.50 to 2.25
19m
PRICE
tencent/hy4-preview cached_input_per_mtok decreased from 0.042 to 0.038
19m
PRICE
z-ai/glm-5.3-flash input_per_mtok decreased from 0.15 to 0.026
19m
PRICE
z-ai/glm-5.3-flash output_per_mtok increased from 0.50 to 0.90
19m
PRICE
z-ai/glm-5.3-flash cached_input_per_mtok decreased from 0.03 to 0.011
19m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0051 to 0.013
19m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 1.28 to 1.60
19m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0051
50m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0051
50m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0051
50m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.60 to 1.28
50m
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0086 to 0.0051
50m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
1h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
1h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0086
1h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.0086
1h
NEW MODEL
inclusionai/ling-3.1-flash appeared in the catalogue
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.013
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0038 to 0.013
2h
PRICE
DeepSeek V4 Flash via OpenRouter: input price ↓ 33%
2h
PRICE
DeepSeek V4 Flash via OpenRouter: output price ↓ 33%
2h
PRICE
deepseek/deepseek-v4-flash input_per_mtok decreased from 0.042 to 0.028
2h
PRICE
deepseek/deepseek-v4-flash output_per_mtok decreased from 0.084 to 0.056
2h
PRICE
deepseek/deepseek-v4-flash cached_input_per_mtok decreased from 0.0084 to 0.0056
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0051
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0051
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0038
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0086 to 0.0038
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0051 to 0.013
19m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
19m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
19m
PRICE
nvidia/nemotron-3-ultra-550b-a55b input_per_mtok increased from 0.50 to 0.60
19m
PRICE
nvidia/nemotron-3-ultra-550b-a55b output_per_mtok increased from 2.20 to 2.40
19m
PRICE
nvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok increased from 0.10 to 0.12
19m
PRICE
tencent/hy3 input_per_mtok decreased from 0.13 to 0.083
19m
PRICE
tencent/hy3 output_per_mtok decreased from 0.53 to 0.33
19m
PRICE
tencent/hy3 cached_input_per_mtok decreased from 0.033 to 0.021
19m
PRICE
tencent/hy4-preview input_per_mtok decreased from 0.83 to 0.75
19m
PRICE
tencent/hy4-preview output_per_mtok decreased from 2.50 to 2.25
19m
PRICE
tencent/hy4-preview cached_input_per_mtok decreased from 0.042 to 0.038
19m
PRICE
z-ai/glm-5.3-flash input_per_mtok decreased from 0.15 to 0.026
19m
PRICE
z-ai/glm-5.3-flash output_per_mtok increased from 0.50 to 0.90
19m
PRICE
z-ai/glm-5.3-flash cached_input_per_mtok decreased from 0.03 to 0.011
19m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0051 to 0.013
19m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 1.28 to 1.60
19m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0051
50m
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0051
50m
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0051
50m
PRICE
~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.60 to 1.28
50m
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0086 to 0.0051
50m
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.012
1h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.012
1h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0086
1h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.0086
1h
NEW MODEL
inclusionai/ling-3.1-flash appeared in the catalogue
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.017
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.017
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.013
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0038 to 0.013
2h
PRICE
DeepSeek V4 Flash via OpenRouter: input price ↓ 33%
2h
PRICE
DeepSeek V4 Flash via OpenRouter: output price ↓ 33%
2h
PRICE
deepseek/deepseek-v4-flash input_per_mtok decreased from 0.042 to 0.028
2h
PRICE
deepseek/deepseek-v4-flash output_per_mtok decreased from 0.084 to 0.056
2h
PRICE
deepseek/deepseek-v4-flash cached_input_per_mtok decreased from 0.0084 to 0.0056
2h
PRICE
deepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.0051
2h
PRICE
deepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.0051
2h
PRICE
~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.0038
2h
PRICE
~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0086 to 0.0038
2h
DeepSeek V4 Flash
on
Scaleway
#1 of 4 providers for DeepSeek V4 Flash · #3 of 6 models on Scaleway · EU
BEST FOR DEEPSEEK V4 FLASH
Compare with other providers
Score
95.6
Rel.
100.0%
Tools
100.0%
JSON
100.0%
TTFT
389 ms
P95
3314 ms
Tok/s
133
Price
$0.46 / $0.92
Ctx
1.3M
217 results · last 292m ago
DeepSeek V4 Flash on other providers
Provider
Score
TTFT
Tok/s
$ Out
Scaleway
THIS PAGE
95.6
389 ms
133
$0.92
Cortecs
92.3
411 ms
73
$0.18
OpenRouter
88.3
1059 ms
89
$0.056
Together
85.7
714 ms
61
$0.28
Other models on Scaleway
Model
Score
TTFT
$ Out
GPT-OSS 120B
91.6
179 ms
$0.69
Llama 3.3 70B
89.9
144 ms
$1.03
DeepSeek V4 Flash
THIS PAGE
87.6
389 ms
$0.92
Qwen3-235B
85.9
162 ms
$2.58
GLM-5.2
80.8
282 ms
$6.30
Mistral Medium 3.5
80.7
164 ms
$8.60