PRICE~moonshotai/kimi-latest input_per_mtok increased from 1.34 to 1.3913mPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0038 to 0.001113mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.008613mPRICEgoogle/gemma-4-26b-a4b-it cached_input_per_mtok decreased from 0.05 to 0.03813mPRICEgoogle/gemma-4-26b-a4b-it output_per_mtok decreased from 0.30 to 0.2313mPRICEgoogle/gemma-4-26b-a4b-it input_per_mtok decreased from 0.09 to 0.06813mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.01213mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.01213mPRICE~z-ai/glm-flash-latest output_per_mtok decreased from 0.90 to 0.6044mPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0058 to 0.003844mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.47 to 1.2044mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.003844mPRICEz-ai/glm-5.2 cached_input_per_mtok increased from 0.26 to 0.3244mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0077 to 0.01744mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0077 to 0.01744mPRICE~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.801hPRICE~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.001hPRICE~moonshotai/kimi-latest input_per_mtok increased from 0.50 to 1.341hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.00581hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.60 to 1.471hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.00581hPRICE~deepseek/deepseek-flash-latest cached_input_per_mtok increased from 0.006 to 0.021hPRICE~deepseek/deepseek-flash-latest output_per_mtok increased from 0.50 to 0.601hPRICEz-ai/glm-5.3-flash cached_input_per_mtok increased from 0.011 to 0.031hPRICEz-ai/glm-5.3-flash output_per_mtok decreased from 0.90 to 0.501hPRICEz-ai/glm-5.3-flash input_per_mtok increased from 0.026 to 0.151hPRICEdeepseek/deepseek-v4.1-flash cached_input_per_mtok increased from 0.006 to 0.021hPRICEdeepseek/deepseek-v4.1-flash output_per_mtok increased from 0.50 to 0.601hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.00771hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.00771hPRICEdeepseek/deepseek-v3.1-terminus input_per_mtok increased from 0.27 to 0.301hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0038 to 0.0132hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.0132hPRICE~deepseek/deepseek-flash-latest output_per_mtok increased from 0.42 to 0.502hPRICEdeepseek/deepseek-v4.1-flash output_per_mtok increased from 0.42 to 0.502hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.0172hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.0172hPRICE~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.292hPRICE~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.362hPRICE~moonshotai/kimi-latest input_per_mtok decreased from 1.34 to 0.502h
Not yet benchmarked

Cohere is in the registry, awaiting benchmark coverage. View the live ranking →

Cohere in the registry

  • HeadquartersCA
  • API protocolscohere, openai chat completions
  • Catalogued endpoints0
  • Websitecohere.com

All providers · How we benchmark