PRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0011 to 0.0128mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.60 to 1.288mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0128mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.0128mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.0128mNEW MODELnvidia/switchyard appeared in the catalogue8mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.6039mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.01339mPRICEnvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok decreased from 0.12 to 0.1039mPRICEnvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.2039mPRICEnvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.5039mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.01739mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.01739mPRICE~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.291hPRICE~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.361hPRICE~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.001hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.95 to 1.041hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.00381hPRICEinclusionai/ling-3.0-flash-fin cached_input_per_mtok decreased from 0.012 to 0.00841hPRICEinclusionai/ling-3.0-flash-fin output_per_mtok decreased from 0.18 to 0.121hPRICEinclusionai/ling-3.0-flash-fin input_per_mtok decreased from 0.06 to 0.0421hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.00511hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.00511hPRICE~z-ai/glm-flash-latest output_per_mtok increased from 0.60 to 0.932hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.20 to 0.952hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.00582hPRICEz-ai/glm-5.2 cached_input_per_mtok decreased from 0.32 to 0.262hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.00772hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.00772hPRICE~moonshotai/kimi-latest input_per_mtok increased from 1.34 to 1.392hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0038 to 0.00112hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.00862hPRICEgoogle/gemma-4-26b-a4b-it cached_input_per_mtok decreased from 0.05 to 0.0382hPRICEgoogle/gemma-4-26b-a4b-it output_per_mtok decreased from 0.30 to 0.232hPRICEgoogle/gemma-4-26b-a4b-it input_per_mtok decreased from 0.09 to 0.0682hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.0122hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.0122hPRICE~z-ai/glm-flash-latest output_per_mtok decreased from 0.90 to 0.603hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0058 to 0.00383hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.47 to 1.203h

DeepSeek V4 Flash on Fireworks

Not yet measured

Fireworks serves DeepSeek V4 Flash (declared in its catalogue), but this pair has not yet been measured from the canonical vantage. Benchmarks appear here with the first canonical run. See measured providers for DeepSeek V4 Flash →