PRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.012 to 0.007715mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.012 to 0.007715mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.007715mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.007715mPRICEdeepseek/deepseek-v3.1-terminus input_per_mtok decreased from 0.30 to 0.2715mPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0011 to 0.01246mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.60 to 1.2846mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.01246mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.01246mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.01246mNEW MODELnvidia/switchyard appeared in the catalogue46mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.601hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.0131hPRICEnvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok decreased from 0.12 to 0.101hPRICEnvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.201hPRICEnvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.501hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.0171hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.0171hPRICE~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.292hPRICE~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.362hPRICE~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.002hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.95 to 1.042hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.00382hPRICEinclusionai/ling-3.0-flash-fin cached_input_per_mtok decreased from 0.012 to 0.00842hPRICEinclusionai/ling-3.0-flash-fin output_per_mtok decreased from 0.18 to 0.122hPRICEinclusionai/ling-3.0-flash-fin input_per_mtok decreased from 0.06 to 0.0422hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.00512hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.00512hPRICE~z-ai/glm-flash-latest output_per_mtok increased from 0.60 to 0.932hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.20 to 0.952hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.00582hPRICEz-ai/glm-5.2 cached_input_per_mtok decreased from 0.32 to 0.262hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.00772hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.00772hPRICE~moonshotai/kimi-latest input_per_mtok increased from 1.34 to 1.393hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0038 to 0.00113hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.00863hPRICEgoogle/gemma-4-26b-a4b-it cached_input_per_mtok decreased from 0.05 to 0.0383hPRICEgoogle/gemma-4-26b-a4b-it output_per_mtok decreased from 0.30 to 0.233hPRICEgoogle/gemma-4-26b-a4b-it input_per_mtok decreased from 0.09 to 0.0683h

Mistral AI — AI inference benchmarks

FR · serverless · 2 benchmarked models · 1 region · EU residency
#3 GLOBALAdd to compare
Overall93.2Rel.100.0%Tools100.0%JSON91.7%TTFT307 msP951009 msTok/s109Price$1.00 / $4.50Δ30d↓ 0.1● last run 4h ago · 8 runs in 24h

Head-to-head: vs OpenRouter · vs Cortecs · vs Together · vs Scaleway

Provider vs market

Percentile across 8 ranked providers
Reliability 100.0%P100
Tools 100.0%P100
Structured 91.7%P13
TTFT 307 msP63
Throughput 109 tok/sP50
Cost $4.50P25

Price vs performance

Mistral AI highlighted vs peers
879196100$4.37$8.74$13.10$17.47Output price $/M →Score ↑Cerebras — $0.75/M out · score 99.0Groq — $0.45/M out · score 98.2Mistral — $4.50/M out · score 93.2MistralScaleway — $1.81/M out · score 92.4Cortecs — $1.23/M out · score 92.2OpenAI — $15.60/M out · score 90.4Together — $1.12/M out · score 85.8OpenRouter — $1.20/M out · score 84.4

30-day trend

Measured daily series
Score93.2
TTFT389 ms
Tools100.0%
Reliability100.0%
Price$1.50

Key positioning

Derived from benchmark percentiles
Strengths
  • Reliability (P100)
  • Tools (P100)
Weaknesses
  • Structured (P13)
  • Cost (P25)
Best suited for

Mistral AI in the registry

  • HeadquartersFR
  • API protocolsopenai chat completions
  • Catalogued endpoints1
  • Websitemistral.ai
  • Last verified2026-10-02

Observed models & declared pricing

Read from Mistral AI's own catalogue by continuous discovery — declared data, not benchmark results.

ModelContextObserved
codestral-2508256k2026-10-02
codestral-embed8k2026-10-02
codestral-embed-25058k2026-10-02
codestral-latest256k2026-10-02
glm-5-21049k2026-10-02
labs-leanstral-1-5262k2026-10-02
labs-leanstral-1-5-1262k2026-10-02
magistral-medium-latest262k2026-10-02
magistral-small-latest262k2026-10-02
ministral-14b-2512262k2026-10-02
ministral-14b-latest262k2026-10-02
ministral-3b-2512131k2026-10-02
ministral-3b-latest131k2026-10-02
ministral-8b-2512262k2026-10-02
ministral-8b-latest262k2026-10-02
mistral-code-fim-latest256k2026-10-02
mistral-code-latest256k2026-10-02
mistral-embed8k2026-10-02
mistral-embed-23128k2026-10-02
mistral-large-2512262k2026-10-02
mistral-large-latest262k2026-10-02
mistral-medium262k2026-10-02
mistral-medium-2604262k2026-10-02
mistral-medium-3262k2026-10-02
mistral-medium-3-5262k2026-10-02
mistral-medium-3.5262k2026-10-02
mistral-medium-latest262k2026-10-02
mistral-moderation-2603131k2026-10-02
mistral-ocr-251216k2026-10-02
mistral-ocr-316k2026-10-02

All providers · How we benchmark