PRICE~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.8010mPRICE~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.0010mPRICE~moonshotai/kimi-latest input_per_mtok decreased from 1.00 to 0.9910mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.007710mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.007710mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.007710mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.60 to 1.2810mPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0011 to 0.007710mPRICEdeepseek/deepseek-v4.1-flash input_per_mtok increased from 0.015 to 0.3041mPRICEdeepseek/deepseek-v4.1-flash output_per_mtok increased from 0.68 to 1.2041mPRICEdeepseek/deepseek-v4.1-flash cached_input_per_mtok increased from 0.0021 to 0.00641mPRICE~deepseek/deepseek-flash-latest cached_input_per_mtok decreased from 0.0021 to 0.002141mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.01341mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.6041mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0077 to 0.0171hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0077 to 0.0171hPRICEdeepseek/deepseek-v4.1-flash input_per_mtok decreased from 0.02 to 0.0151hPRICEdeepseek/deepseek-v4.1-flash output_per_mtok increased from 0.60 to 0.681hPRICEdeepseek/deepseek-v4.1-flash cached_input_per_mtok decreased from 0.02 to 0.00211hPRICE~deepseek/deepseek-flash-latest input_per_mtok decreased from 0.02 to 0.0151hPRICE~deepseek/deepseek-flash-latest output_per_mtok increased from 0.60 to 0.681hPRICE~deepseek/deepseek-flash-latest cached_input_per_mtok decreased from 0.02 to 0.00211hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0077 to 0.00381hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.28 to 1.041hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0077 to 0.00111hPRICEdeepseek/deepseek-v3.1-terminus input_per_mtok decreased from 0.30 to 0.272hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.00772hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.00772hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.012 to 0.00772hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.012 to 0.00772hNEW MODELnvidia/switchyard appeared in the catalogue2hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.0122hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.0122hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.0122hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.60 to 1.282hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0011 to 0.0122hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.0173hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.0173hPRICEnvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.503hPRICEnvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.203h
Not yet benchmarked

Google Vertex AI is in the registry, awaiting benchmark coverage. View the live ranking →

Google Vertex AI in the registry

  • Parent companyAlphabet
  • HeadquartersUS
  • API protocolsgoogle vertex, anthropic messages
  • Catalogued endpoints0
  • Websitecloud.google.com/vertex-ai

All providers · How we benchmark