PRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.012 to 0.007716mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.012 to 0.007716mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.007716mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.007716mPRICEdeepseek/deepseek-v3.1-terminus input_per_mtok decreased from 0.30 to 0.2716mPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0011 to 0.01247mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.60 to 1.2847mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.01247mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.01247mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.01247mNEW MODELnvidia/switchyard appeared in the catalogue47mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.601hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.0131hPRICEnvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok decreased from 0.12 to 0.101hPRICEnvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.201hPRICEnvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.501hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.0171hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.0171hPRICE~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.292hPRICE~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.362hPRICE~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.002hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.95 to 1.042hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.00382hPRICEinclusionai/ling-3.0-flash-fin cached_input_per_mtok decreased from 0.012 to 0.00842hPRICEinclusionai/ling-3.0-flash-fin output_per_mtok decreased from 0.18 to 0.122hPRICEinclusionai/ling-3.0-flash-fin input_per_mtok decreased from 0.06 to 0.0422hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.00512hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.00512hPRICE~z-ai/glm-flash-latest output_per_mtok increased from 0.60 to 0.932hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.20 to 0.952hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.00582hPRICEz-ai/glm-5.2 cached_input_per_mtok decreased from 0.32 to 0.262hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.00772hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.00772hPRICE~moonshotai/kimi-latest input_per_mtok increased from 1.34 to 1.393hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0038 to 0.00113hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.00863hPRICEgoogle/gemma-4-26b-a4b-it cached_input_per_mtok decreased from 0.05 to 0.0383hPRICEgoogle/gemma-4-26b-a4b-it output_per_mtok decreased from 0.30 to 0.233hPRICEgoogle/gemma-4-26b-a4b-it input_per_mtok decreased from 0.09 to 0.0683h

Llama 3.3 70B on Cortecs

#4 of 4 providers for Llama 3.3 70B · #4 of 11 models on Cortecs · EU
Compare with other providers
Score87.8Rel.100.0%Tools98.0%JSON100.0%TTFT441 msP951051 msTok/s51Price$0.75 / $0.75Ctx128k217 results · last 603m ago

Llama 3.3 70B on other providers

ProviderScoreTTFTTok/s$ Out
Scaleway93.0144 ms86$1.03
Together89.0618 ms61$1.04
OpenRouter87.9576 ms38$0.32
CortecsTHIS PAGE87.8441 ms51$0.75

Other models on Cortecs

ModelScoreTTFT$ Out
GPT-OSS 20B97.5175 ms$0.17
DeepSeek V4 Flash94.4411 ms$0.18
GPT-OSS 120B92.8240 ms$0.46
Llama 3.3 70BTHIS PAGE87.7441 ms$0.75
MiniMax M384.4517 ms$1.23
Qwen3-235B82.2937 ms$0.47
GLM-5.281.4425 ms$3.33
Mistral Large 381.2413 ms$1.89
Mistral Medium 3.579.9261 ms$8.07
DeepSeek V4 Pro79.5480 ms$3.50
Kimi K373.7624 ms$15.43

1 more model declared in Cortecs's catalogue — not yet measured from the canonical vantage.