PRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.6029mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.01329mPRICEnvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok decreased from 0.12 to 0.1029mPRICEnvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.2029mPRICEnvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.5029mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.01729mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.01729mPRICE~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.291hPRICE~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.361hPRICE~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.001hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.95 to 1.041hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.00381hPRICEinclusionai/ling-3.0-flash-fin cached_input_per_mtok decreased from 0.012 to 0.00841hPRICEinclusionai/ling-3.0-flash-fin output_per_mtok decreased from 0.18 to 0.121hPRICEinclusionai/ling-3.0-flash-fin input_per_mtok decreased from 0.06 to 0.0421hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.00511hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.00511hPRICE~z-ai/glm-flash-latest output_per_mtok increased from 0.60 to 0.932hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.20 to 0.952hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.00582hPRICEz-ai/glm-5.2 cached_input_per_mtok decreased from 0.32 to 0.262hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.00772hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.00772hPRICE~moonshotai/kimi-latest input_per_mtok increased from 1.34 to 1.392hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0038 to 0.00112hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.00862hPRICEgoogle/gemma-4-26b-a4b-it cached_input_per_mtok decreased from 0.05 to 0.0382hPRICEgoogle/gemma-4-26b-a4b-it output_per_mtok decreased from 0.30 to 0.232hPRICEgoogle/gemma-4-26b-a4b-it input_per_mtok decreased from 0.09 to 0.0682hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.0122hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.0122hPRICE~z-ai/glm-flash-latest output_per_mtok decreased from 0.90 to 0.603hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0058 to 0.00383hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.47 to 1.203hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.00383hPRICEz-ai/glm-5.2 cached_input_per_mtok increased from 0.26 to 0.323hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0077 to 0.0173hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0077 to 0.0173hPRICE~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.803hPRICE~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.003h

Llama 3.3 70B on Together

#2 of 4 providers for Llama 3.3 70B · #4 of 6 models on Together · US
Compare with other providers
Score89.0Rel.100.0%Tools98.0%JSON100.0%TTFT618 msP951761 msTok/s61Price$1.04 / $1.04Ctx128k217 results · last 153m ago

Llama 3.3 70B on other providers

ProviderScoreTTFTTok/s$ Out
Scaleway93.0144 ms86$1.03
TogetherTHIS PAGE89.0618 ms61$1.04
OpenRouter87.9576 ms38$0.32
Cortecs87.8441 ms51$0.75

Other models on Together

ModelScoreTTFT$ Out
DeepSeek V4 Flash87.4714 ms$0.28
GPT-OSS 120B87.2182 ms$0.60
MiniMax M383.7542 ms$1.20
Llama 3.3 70BTHIS PAGE83.6618 ms$1.04
GLM-5.282.5271 ms$4.40
Kimi K373.4602 ms$13.50

4 more models declared in Together's catalogue — not yet measured from the canonical vantage.