PRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.012 to 0.007715mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.012 to 0.007715mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.007715mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.007715mPRICEdeepseek/deepseek-v3.1-terminus input_per_mtok decreased from 0.30 to 0.2715mPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok increased from 0.0011 to 0.01246mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.60 to 1.2846mPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.013 to 0.01246mPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.017 to 0.01246mPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.017 to 0.01246mNEW MODELnvidia/switchyard appeared in the catalogue46mPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.04 to 0.601hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.0131hPRICEnvidia/nemotron-3-ultra-550b-a55b cached_input_per_mtok decreased from 0.12 to 0.101hPRICEnvidia/nemotron-3-ultra-550b-a55b output_per_mtok decreased from 2.40 to 2.201hPRICEnvidia/nemotron-3-ultra-550b-a55b input_per_mtok decreased from 0.60 to 0.501hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok increased from 0.0051 to 0.0171hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok increased from 0.0051 to 0.0171hPRICE~moonshotai/kimi-latest cached_input_per_mtok decreased from 0.80 to 0.292hPRICE~moonshotai/kimi-latest output_per_mtok decreased from 13.00 to 11.362hPRICE~moonshotai/kimi-latest input_per_mtok decreased from 1.39 to 1.002hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok increased from 0.95 to 1.042hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0058 to 0.00382hPRICEinclusionai/ling-3.0-flash-fin cached_input_per_mtok decreased from 0.012 to 0.00842hPRICEinclusionai/ling-3.0-flash-fin output_per_mtok decreased from 0.18 to 0.122hPRICEinclusionai/ling-3.0-flash-fin input_per_mtok decreased from 0.06 to 0.0422hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.0077 to 0.00512hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.0077 to 0.00512hPRICE~z-ai/glm-flash-latest output_per_mtok increased from 0.60 to 0.932hPRICE~deepseek/deepseek-v4-flash-latest output_per_mtok decreased from 1.20 to 0.952hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok decreased from 0.0086 to 0.00582hPRICEz-ai/glm-5.2 cached_input_per_mtok decreased from 0.32 to 0.262hPRICEdeepseek/deepseek-v4-flash-0731 cached_input_per_mtok decreased from 0.012 to 0.00772hPRICEdeepseek/deepseek-v4-flash-0731 input_per_mtok decreased from 0.012 to 0.00772hPRICE~moonshotai/kimi-latest input_per_mtok increased from 1.34 to 1.393hPRICE~deepseek/deepseek-v4-flash-latest cached_input_per_mtok decreased from 0.0038 to 0.00113hPRICE~deepseek/deepseek-v4-flash-latest input_per_mtok increased from 0.0038 to 0.00863hPRICEgoogle/gemma-4-26b-a4b-it cached_input_per_mtok decreased from 0.05 to 0.0383hPRICEgoogle/gemma-4-26b-a4b-it output_per_mtok decreased from 0.30 to 0.233hPRICEgoogle/gemma-4-26b-a4b-it input_per_mtok decreased from 0.09 to 0.0683h
Not yet benchmarked

Nebius Token Factory is in the registry with 1 catalogued endpoints, awaiting benchmark coverage. View the live ranking →

Nebius Token Factory in the registry

  • HeadquartersNL
  • API protocolsopenai chat completions
  • Catalogued endpoints1
  • Websitenebius.com
  • Last verified2026-10-02

Observed models & declared pricing

Read from Nebius Token Factory's own catalogue by continuous discovery — declared data, not benchmark results.

ModelContext$ in / M$ out / MObserved
deepseek-ai/DeepSeek-V4-Flash-07311024k0.140.282026-10-02
deepseek-ai/DeepSeek-V4-Pro1049k1.753.502026-10-02
deepseek-ai/DeepSeek-V4-Pro-0813979k1.323.962026-10-02
deepseek-ai/DeepSeek-V4.1-Flash1048k0.301.202026-10-02
google/gemma-3-27b-it110k0.100.302026-10-02
MiniMaxAI/MiniMax-M31049k0.301.202026-10-02
moonshotai/Kimi-K2.6262k0.954.002026-10-02
moonshotai/Kimi-K2.7-Code262k0.954.002026-10-02
moonshotai/Kimi-K31024k3.0015.002026-10-02
NousResearch/Hermes-4-405B131k1.003.002026-10-02
nvidia/Nemotron-3_5-Lightning1049k0.060.242026-10-02
nvidia/nemotron-3-super-120b-a12b262k0.300.902026-10-02
nvidia/Nemotron-3-Ultra-550b-a55b1049k1.003.002026-10-02
nvidia/NVIDIA-Nemotron-3-Nano-30B-A3B262k0.060.242026-10-02
openai/gpt-oss-120b131k0.150.602026-10-02
openbmb/MiniCPM-V-4_532k0.661.112026-10-02
Qwen/Qwen3-235B-A22B-Instruct-2507262k0.200.602026-10-02
Qwen/Qwen3-30B-A3B-Instruct-2507262k0.100.302026-10-02
Qwen/Qwen3-Embedding-8B41k0.01—2026-10-02
Qwen/Qwen3.5-397B-A17B262k0.603.602026-10-02
Qwen/Qwen3.8-27B262k0.453.002026-10-02
zai-org/GLM-5.1203k1.404.402026-10-02
zai-org/GLM-5.21049k1.404.402026-10-02
zai-org/GLM-5.31024k1.404.402026-10-02
zai-org/GLM-5.3-Flash1024k0.150.502026-10-02

All providers · How we benchmark