PRICE~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.2926mPRICE~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.3626mPRICE~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.0026mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.95 to 1.0426mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.003826mPRICEinclusionai/ling-3.0-flash-fin cached_input_per_mtok decreased from 0.012 to 0.008426mPRICEinclusionai/ling-3.0-flash-fin output_per_mtok decreased from 0.18 to 0.1226mPRICEinclusionai/ling-3.0-flash-fin input_per_mtok decreased from 0.06 to 0.04226mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.005126mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.005126mPRICE~z-ai/glm-flash-latest output_per_mtok increased from 0.60 to 0.9357mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.20 to 0.9557mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.005857mPRICEz-ai/glm-5.2 cached_input_per_mtok decreased from 0.32 to 0.2657mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.007757mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.007757mPRICE~moonshotai/kimi-latest input_per_mtok increased from 1.34 to 1.391hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0038 to 0.00111hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.00861hPRICEgoogle/gemma-4-26b-a4b-it cached_input_per_mtok decreased from 0.05 to 0.0381hPRICEgoogle/gemma-4-26b-a4b-it output_per_mtok decreased from 0.30 to 0.231hPRICEgoogle/gemma-4-26b-a4b-it input_per_mtok decreased from 0.09 to 0.0681hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.0121hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.0121hPRICE~z-ai/glm-flash-latest output_per_mtok decreased from 0.90 to 0.602hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0058 to 0.00382hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.47 to 1.202hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.00382hPRICEz-ai/glm-5.2 cached_input_per_mtok increased from 0.26 to 0.322hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0077 to 0.0172hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0077 to 0.0172hPRICE~moonshotai/kimi-latest cached_input_per_mtok increased from 0.29 to 0.803hPRICE~moonshotai/kimi-latest output_per_mtok increased from 11.36 to 13.003hPRICE~moonshotai/kimi-latest input_per_mtok increased from 0.50 to 1.343hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.013 to 0.00583hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.60 to 1.473hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.00583hPRICE~deepseek/deepseek-flash-latest cached_input_per_mtok increased from 0.006 to 0.023hPRICE~deepseek/deepseek-flash-latest output_per_mtok increased from 0.50 to 0.603hPRICEz-ai/glm-5.3-flash cached_input_per_mtok increased from 0.011 to 0.033h

Groq — AI inference benchmarks

US · serverless · 2 benchmarked models · 1 region
#2 GLOBALAdd to compare
Overall98.2Rel.100.0%Tools100.0%JSON100.0%TTFT261 msP95385 msTok/s708Price$0.11 / $0.45Δ30d↑ 0.1● last run 14h ago · 8 runs in 24h

Head-to-head: vs Cerebras · vs OpenRouter · vs Cortecs · vs Together · vs Scaleway

Provider vs market

Percentile across 8 ranked providers
Reliability 100.0%P100
Tools 100.0%P100
Structured 100.0%P100
TTFT 261 msP75
Throughput 708 tok/sP88
Cost $0.45P100

Price vs performance

Groq highlighted vs peers
879196100$4.37$8.74$13.10$17.47Output price $/M →Score ↑Cerebras — $0.75/M out · score 99.0Groq — $0.45/M out · score 98.2GroqMistral — $4.50/M out · score 93.2Scaleway — $1.81/M out · score 92.4Cortecs — $1.23/M out · score 92.2OpenAI — $15.60/M out · score 90.4Together — $1.12/M out · score 85.8OpenRouter — $1.20/M out · score 84.4

30-day trend

Measured daily series
Score98.2
TTFT264 ms
Tools100.0%
Reliability100.0%
Price$0.60

Key positioning

Derived from benchmark percentiles
Strengths
  • Reliability (P100)
  • Tools (P100)
  • Structured (P100)
  • TTFT (P75)
  • Throughput (P88)
  • Cost (P100)
Weaknesses
  • No P40-or-below metric
Best suited for

Groq in the registry

  • HeadquartersUS
  • API protocolsopenai chat completions
  • Catalogued endpoints1
  • Websitegroq.com
  • Last verified2026-10-02

Observed models & declared pricing

Read from Groq's own catalogue by continuous discovery — declared data, not benchmark results.

ModelContextObserved
allam-2-7b4k2026-10-02
canopylabs/orpheus-arabic-saudi4k2026-10-02
canopylabs/orpheus-v1-english4k2026-10-02
meta-llama/llama-prompt-guard-2-22m1k2026-10-02
meta-llama/llama-prompt-guard-2-86m1k2026-10-02
openai/gpt-oss-120b131k2026-10-02
openai/gpt-oss-20b131k2026-10-02
openai/gpt-oss-safeguard-20b131k2026-10-02
qwen/qwen3.8-27b131k2026-10-02
whisper-large-v30k2026-10-02
whisper-large-v3-turbo0k2026-10-02

All providers · How we benchmark