PRICE~z-ai/glm-latest cached_input_per_mtok decreased from 0.18 to 0.0624mPRICE~z-ai/glm-latest output_per_mtok increased from 2.99 to 4.0024mPRICE~z-ai/glm-latest input_per_mtok increased from 0.083 to 0.1224mPRICE~z-ai/glm-flash-latest cached_input_per_mtok decreased from 0.026 to 0.01324mPRICE~z-ai/glm-flash-latest output_per_mtok increased from 0.63 to 0.9024mPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0086 to 0.005824mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.005824mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.007724mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.007724mPRICE~z-ai/glm-latest cached_input_per_mtok increased from 0.06 to 0.1855mPRICE~z-ai/glm-latest output_per_mtok decreased from 4.00 to 2.9955mPRICE~z-ai/glm-latest input_per_mtok decreased from 0.12 to 0.08355mPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.008655mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.008655mPRICE~deepseek/deepseek-flash-latest cached_input_per_mtok decreased from 0.02 to 0.01555mPRICE~deepseek/deepseek-flash-latest output_per_mtok increased from 0.60 to 0.7555mPRICE~deepseek/deepseek-flash-latest input_per_mtok decreased from 0.02 to 0.01555mPRICEdeepseek/deepseek-v4.1-flash cached_input_per_mtok increased from 0.0038 to 0.01555mPRICEdeepseek/deepseek-v4.1-flash input_per_mtok decreased from 0.03 to 0.01555mPRICEdeepseek/deepseek-v4-pro-0813 cached_input_per_mtok increased from 0.022 to 0.04455mPRICEdeepseek/deepseek-v4-pro-0813 output_per_mtok increased from 1.98 to 3.9655mPRICEdeepseek/deepseek-v4-pro-0813 input_per_mtok increased from 0.66 to 1.3255mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.01255mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.01255mPRICE~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.291hPRICE~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.201hPRICE~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.201hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0038 to 0.0131hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.0131hPRICE~deepseek/deepseek-flash-latest cached_input_per_mtok increased from 0.0038 to 0.021hPRICE~deepseek/deepseek-flash-latest output_per_mtok decreased from 0.75 to 0.601hPRICE~deepseek/deepseek-flash-latest input_per_mtok decreased from 0.03 to 0.021hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.0171hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.0171hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0077 to 0.00382hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 1.28 to 1.602hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0077 to 0.00382hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.00512hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.00512hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.00772h

GPT-OSS 120B on Fireworks

Not yet measured

Fireworks serves GPT-OSS 120B (declared in its catalogue), but this pair has not yet been measured from the canonical vantage. Benchmarks appear here with the first canonical run. See measured providers for GPT-OSS 120B →