PRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.606mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.0136mPRICEnvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok decreased from 0.12 to 0.106mPRICEnvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.206mPRICEnvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.506mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.0176mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.0176mPRICE~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.2937mPRICE~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.3637mPRICE~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.0037mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.95 to 1.0437mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.003837mPRICEinclusionai/ling-3.0-flash-fin cached_input_per_mtok decreased from 0.012 to 0.008437mPRICEinclusionai/ling-3.0-flash-fin output_per_mtok decreased from 0.18 to 0.1237mPRICEinclusionai/ling-3.0-flash-fin input_per_mtok decreased from 0.06 to 0.04237mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.005137mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.005137mPRICE~z-ai/glm-flash-latest output_per_mtok increased from 0.60 to 0.931hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.20 to 0.951hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.00581hPRICEz-ai/glm-5.2 cached_input_per_mtok decreased from 0.32 to 0.261hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.00771hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.00771hPRICE~moonshotai/kimi-latest input_per_mtok increased from 1.34 to 1.392hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0038 to 0.00112hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.00862hPRICEgoogle/gemma-4-26b-a4b-it cached_input_per_mtok decreased from 0.05 to 0.0382hPRICEgoogle/gemma-4-26b-a4b-it output_per_mtok decreased from 0.30 to 0.232hPRICEgoogle/gemma-4-26b-a4b-it input_per_mtok decreased from 0.09 to 0.0682hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.0122hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.0122hPRICE~z-ai/glm-flash-latest output_per_mtok decreased from 0.90 to 0.602hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0058 to 0.00382hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.47 to 1.202hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.00382hPRICEz-ai/glm-5.2 cached_input_per_mtok increased from 0.26 to 0.322hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0077 to 0.0172hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0077 to 0.0172hPRICE~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.803hPRICE~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.003h

Kimi K3 on Cortecs

#1 of 3 providers for Kimi K3 · #11 of 11 models on Cortecs · EU
BEST FOR KIMI K3Compare with other providers
Score88.0Rel.100.0%Tools100.0%JSON100.0%TTFT624 msP951566 msTok/s171Price$3.09 / $15.43Ctx1M217 results · last 531m ago

Kimi K3 on other providers

ProviderScoreTTFTTok/s$ Out
CortecsTHIS PAGE88.0624 ms171$15.43
Together82.6602 ms104$13.50
OpenRouter76.2674 ms90$13.50

Other models on Cortecs

ModelScoreTTFT$ Out
GPT-OSS 20B97.5175 ms$0.17
DeepSeek V4 Flash94.4411 ms$0.18
GPT-OSS 120B92.8240 ms$0.46
Llama 3.3 70B87.7441 ms$0.75
MiniMax M384.4517 ms$1.23
Qwen3-235B82.2937 ms$0.47
GLM-5.281.4425 ms$3.33
Mistral Large 381.2413 ms$1.89
Mistral Medium 3.579.9261 ms$8.07
DeepSeek V4 Pro79.5480 ms$3.50
Kimi K3THIS PAGE73.7624 ms$15.43

1 more model declared in Cortecs's catalogue — not yet measured from the canonical vantage.