PRICE~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.8013mPRICE~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.0013mPRICE~moonshotai/kimi-latest input_per_mtok decreased from 1.00 to 0.9913mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.007713mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.007713mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.007713mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.60 to 1.2813mPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0011 to 0.007713mPRICEdeepseek/deepseek-v4.1-flash input_per_mtok increased from 0.015 to 0.3044mPRICEdeepseek/deepseek-v4.1-flash output_per_mtok increased from 0.68 to 1.2044mPRICEdeepseek/deepseek-v4.1-flash cached_input_per_mtok increased from 0.0021 to 0.00644mPRICE~deepseek/deepseek-flash-latest cached_input_per_mtok decreased from 0.0021 to 0.002144mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.01344mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.6044mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0077 to 0.0171hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0077 to 0.0171hPRICEdeepseek/deepseek-v4.1-flash input_per_mtok decreased from 0.02 to 0.0151hPRICEdeepseek/deepseek-v4.1-flash output_per_mtok increased from 0.60 to 0.681hPRICEdeepseek/deepseek-v4.1-flash cached_input_per_mtok decreased from 0.02 to 0.00211hPRICE~deepseek/deepseek-flash-latest input_per_mtok decreased from 0.02 to 0.0151hPRICE~deepseek/deepseek-flash-latest output_per_mtok increased from 0.60 to 0.681hPRICE~deepseek/deepseek-flash-latest cached_input_per_mtok decreased from 0.02 to 0.00211hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0077 to 0.00381hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.28 to 1.041hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0077 to 0.00111hPRICEdeepseek/deepseek-v3.1-terminus input_per_mtok decreased from 0.30 to 0.272hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.00772hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.00772hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.012 to 0.00772hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.012 to 0.00772hNEW MODELnvidia/switchyard appeared in the catalogue2hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.0122hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.0122hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0122hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.60 to 1.282hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0011 to 0.0122hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.0173hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.0173hPRICEnvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.503hPRICEnvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.203h

Cerebras vs Fireworks

Not yet comparable

Cerebras and Fireworks share 1 declared model, but a head-to-head publishes only when both sides carry canonical measurements on a shared model. See the live ranking →