PRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0051 to 0.01319mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.01719mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.01719mPRICEnvidia/nemotron-3-ultra-550b-a55b input_per_mtok increased from 0.50 to 0.6019mPRICEnvidia/nemotron-3-ultra-550b-a55b output_per_mtok increased from 2.20 to 2.4019mPRICEnvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok increased from 0.10 to 0.1219mPRICEtencent/hy3 input_per_mtok decreased from 0.13 to 0.08319mPRICEtencent/hy3 output_per_mtok decreased from 0.53 to 0.3319mPRICEtencent/hy3 cached_input_per_mtok decreased from 0.033 to 0.02119mPRICEtencent/hy4-preview input_per_mtok decreased from 0.83 to 0.7519mPRICEtencent/hy4-preview output_per_mtok decreased from 2.50 to 2.2519mPRICEtencent/hy4-preview cached_input_per_mtok decreased from 0.042 to 0.03819mPRICEz-ai/glm-5.3-flash input_per_mtok decreased from 0.15 to 0.02619mPRICEz-ai/glm-5.3-flash output_per_mtok increased from 0.50 to 0.9019mPRICEz-ai/glm-5.3-flash cached_input_per_mtok decreased from 0.03 to 0.01119mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0051 to 0.01319mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 1.28 to 1.6019mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.005150mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.005150mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.005150mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.60 to 1.2850mPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0086 to 0.005150mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.0121hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.0121hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.00861hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.00861hNEW MODELinclusionai/ling-3.1-flash appeared in the catalogue2hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.0172hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.0172hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.0132hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0038 to 0.0132hPRICEDeepSeek V4 Flash via OpenRouter: input price ↓ 33%2hPRICEDeepSeek V4 Flash via OpenRouter: output price ↓ 33%2hPRICEdeepseek/deepseek-v4-flash input_per_mtok decreased from 0.042 to 0.0282hPRICEdeepseek/deepseek-v4-flash output_per_mtok decreased from 0.084 to 0.0562hPRICEdeepseek/deepseek-v4-flash cached_input_per_mtok decreased from 0.0084 to 0.00562hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.00512hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.00512hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.00382hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0086 to 0.00382h

DeepSeek V4 Flash on Together

#4 of 4 providers for DeepSeek V4 Flash · #1 of 6 models on Together · US
Compare with other providers
Score85.7Rel.98.6%Tools100.0%JSON100.0%TTFT714 msP951866 msTok/s61Price$0.14 / $0.28Ctx1.3M217 results · last 507m ago

DeepSeek V4 Flash on other providers

ProviderScoreTTFTTok/s$ Out
Scaleway95.6389 ms133$0.92
Cortecs92.3411 ms73$0.18
OpenRouter88.31059 ms89$0.056
TogetherTHIS PAGE85.7714 ms61$0.28

Other models on Together

ModelScoreTTFT$ Out
DeepSeek V4 FlashTHIS PAGE87.4714 ms$0.28
GPT-OSS 120B87.2182 ms$0.60
MiniMax M383.7542 ms$1.20
Llama 3.3 70B83.4632 ms$1.04
GLM-5.282.5271 ms$4.40
Kimi K373.4602 ms$13.50

4 more models declared in Together's catalogue — not yet measured from the canonical vantage.