PRICE~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.2928mPRICE~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.3628mPRICE~moonshotai/kimi-latest input_per_mtok decreased from 0.99 to 0.7528mPRICE~deepseek/deepseek-pro-latest cached_input_per_mtok increased from 0.0042 to 0.1028mPRICE~deepseek/deepseek-pro-latest output_per_mtok increased from 0.40 to 4.2028mPRICE~deepseek/deepseek-pro-latest input_per_mtok decreased from 0.13 to 0.1328mPRICE~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.8059mPRICE~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.0059mPRICE~moonshotai/kimi-latest input_per_mtok increased from 0.75 to 0.9959mPERFORMANCEGLM-5.2 → Scaleway: TTFT ↑ 20%2hPERFORMANCEDeepSeek V4 Flash → Scaleway: TTFT ↑ 35%2hPERFORMANCEMistral Medium 3.5 → Scaleway: TTFT ↓ 21%2hPERFORMANCEDeepSeek V4 Flash → Scaleway: throughput ↓ 20%2hPERFORMANCEGPT-OSS 120B → Scaleway: throughput ↑ 31%2hPERFORMANCEGPT-OSS 120B → Scaleway: TTFT ↓ 24%2hPERFORMANCEGPT-OSS 120B → Together AI: throughput ↑ 20%2hPERFORMANCEKimi K3 via OpenRouter: TTFT ↓ 49%2hPERFORMANCEGLM-5.2 via OpenRouter: reliability recovered 96.8% → 100.0%2hPERFORMANCEKimi K3 via Cortecs: throughput ↑ 184%2hPERFORMANCEKimi K3 via Cortecs: TTFT ↓ 42%2hPERFORMANCEGLM-5.2 via OpenRouter: throughput ↓ 49%2hPERFORMANCEGLM-5.2 via OpenRouter: TTFT ↑ 121%2hPERFORMANCEMiniMax M3 via OpenRouter: reliability recovered 96.8% → 100.0%2hPERFORMANCEDeepSeek V4 Pro via Cortecs: throughput ↑ 27%2hPERFORMANCEGPT-OSS 120B via OpenRouter: throughput ↓ 22%2hPERFORMANCEGLM-4.7 via OpenRouter: TTFT ↓ 78%2hPERFORMANCEGPT-OSS 20B → Groq: TTFT ↑ 24%2hPERFORMANCEKimi K3 → Together AI: TTFT ↓ 34%2hPERFORMANCEDeepSeek V4 Flash via OpenRouter: throughput ↓ 17%2hPERFORMANCELlama 3.3 70B via Cortecs: TTFT ↓ 51%2hPERFORMANCEQwen3 235B via OpenRouter: throughput ↑ 37%2hPERFORMANCEQwen3 235B via OpenRouter: TTFT ↓ 29%2hPERFORMANCEDeepSeek V4 Flash → Together AI: throughput ↑ 19%2hPERFORMANCEGLM-5.3 via OpenRouter: throughput ↓ 17%2hPERFORMANCEGPT-OSS 20B via Cortecs: throughput ↑ 28%2hPERFORMANCELlama 3.3 70B → Together AI: TTFT ↓ 33%2hPRICE~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.292hPRICE~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.362hPRICE~moonshotai/kimi-latest input_per_mtok decreased from 0.99 to 0.752hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0077 to 0.00112h

DeepSeek V4 Pro on Cortecs

#1 of 2 providers for DeepSeek V4 Pro · #10 of 11 models on Cortecs · EU
Compare with other providers
Score90.6Rel.100.0%Tools100.0%JSON95.2%TTFT480 msP953019 msTok/s140Price$1.75 / $3.50Ctx1M217 results · last 800m ago

DeepSeek V4 Pro on other providers

ProviderScoreTTFTTok/s$ Out
CortecsTHIS PAGE90.6480 ms140$3.50
OpenRouter88.21086 ms63$0.42

Other models on Cortecs

ModelScoreTTFT$ Out
GPT-OSS 20B97.5175 ms$0.17
DeepSeek V4 Flash94.4411 ms$0.18
GPT-OSS 120B92.8240 ms$0.46
Llama 3.3 70B87.7441 ms$0.75
MiniMax M384.4517 ms$1.23
Qwen3-235B82.2937 ms$0.47
GLM-5.281.4425 ms$3.33
Mistral Large 381.2413 ms$1.89
Mistral Medium 3.579.8262 ms$8.07
DeepSeek V4 ProTHIS PAGE79.5480 ms$3.50
Kimi K373.7624 ms$15.43

1 more model declared in Cortecs's catalogue — not yet measured from the canonical vantage.