PRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0077 to 0.001126mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.28 to 1.0426mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0077 to 0.003826mPRICE~deepseek/deepseek-flash-latest cached_input_per_mtok decreased from 0.02 to 0.002126mPRICE~deepseek/deepseek-flash-latest output_per_mtok increased from 0.60 to 0.6826mPRICE~deepseek/deepseek-flash-latest input_per_mtok decreased from 0.02 to 0.01526mPRICEdeepseek/deepseek-v4.1-flash cached_input_per_mtok decreased from 0.02 to 0.002126mPRICEdeepseek/deepseek-v4.1-flash output_per_mtok increased from 0.60 to 0.6826mPRICEdeepseek/deepseek-v4.1-flash input_per_mtok decreased from 0.02 to 0.01526mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0077 to 0.01726mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0077 to 0.01726mPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.012 to 0.007757mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.012 to 0.007757mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.007757mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.007757mPRICEdeepseek/deepseek-v3.1-terminus input_per_mtok decreased from 0.30 to 0.2757mPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0011 to 0.0121hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.60 to 1.281hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0121hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.0121hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.0121hNEW MODELnvidia/switchyard appeared in the catalogue1hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.602hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.0132hPRICEnvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok decreased from 0.12 to 0.102hPRICEnvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.202hPRICEnvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.502hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.0172hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.0172hPRICE~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.292hPRICE~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.362hPRICE~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.002hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.95 to 1.042hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.00382hPRICEinclusionai/ling-3.0-flash-fin cached_input_per_mtok decreased from 0.012 to 0.00842hPRICEinclusionai/ling-3.0-flash-fin output_per_mtok decreased from 0.18 to 0.122hPRICEinclusionai/ling-3.0-flash-fin input_per_mtok decreased from 0.06 to 0.0422hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.00512hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.00512hPRICE~z-ai/glm-flash-latest output_per_mtok increased from 0.60 to 0.933h

Cerebras vs Scaleway

3 shared models · US vs FR · independent benchmarks

Registry facts

FactCerebrasScaleway
Typeinference hostsovereign cloud
HeadquartersUSFR
Catalogued endpoints11
EU residencyNoYes

GPT-OSS 120B: Cerebras vs Scaleway

● MEASURED Cerebras detail → · ● MEASURED Scaleway detail →

MetricCerebrasScaleway
TTFT p50184 ms179 ms
TTFT p95323 ms2214 ms
Throughput1749 tok/s96 tok/s
Reliability100%100%
Tool calling100%100%
Structured output100%100%
$ output / M tokens$0.75$0.69

Every figure above is an independent measurement from the canonical vantage; unmeasured fields show — until measured. How we benchmark →