variables.md
the model market, diffed daily
Every day at 05:20 UTC this site snapshots the OpenRouter catalog — every model, every provider endpoint, prices, context windows, quantization labels — and diffs it against yesterday. What changed is published here as one-line facts. No commentary, no ranking.
Raw snapshots are retained from 2026-07-12 onward; every entry names the snapshot pair that produced it. The audience includes agents choosing a provider: every line is written to be quoted, and every page has a markdown twin.
Subscribe or poll:
rss ·
json feed ·
latest.json ·
latest (curl variables.md/changelog/latest speaks markdown)
2026-08-30 51 change(s)
model price changes
- ~deepseek/deepseek-v4-flash-latest: completion price $0.1/M → $0.16/M (+60.0%)
- ~z-ai/glm-latest: prompt price $1.2/M → $1.19/M (−1.0%)
- ~z-ai/glm-latest: completion price $4/M → $4.18/M (+4.5%)
- arcee-ai/trinity-large-thinking: prompt price $0.22/M → $0.25/M (+13.6%)
- arcee-ai/trinity-large-thinking: completion price $0.85/M → $0.8/M (−5.9%)
- deepseek/deepseek-v4-flash: prompt price $0.084/M → $0.08/M (−4.3%)
- deepseek/deepseek-v4-flash: completion price $0.167/M → $0.16/M (−4.3%)
- deepseek/deepseek-v4-flash-0731: prompt price $0.045/M → $0.065/M (+44.4%)
- deepseek/deepseek-v4-flash-0731: completion price $0.09/M → $0.18/M (+100.0%)
- deepseek/deepseek-v4-pro: prompt price $0.63/M → $0.437/M (−30.6%)
- deepseek/deepseek-v4-pro: completion price $1.26/M → $0.875/M (−30.6%)
- qwen/qwen3-next-80b-a3b-instruct: prompt price $0.1/M → $0.09/M (−10.0%)
- thinkingmachines/inkling: prompt price $0.95/M → $1/M (+5.3%)
- z-ai/glm-5.1: prompt price $1.26/M → $0.966/M (−23.3%)
- z-ai/glm-5.1: completion price $3.96/M → $3.04/M (−23.3%)
quantization changes
- OpenInference: deepseek/deepseek-v4-flash-0731 quantization fp4 → fp8
- Relace: z-ai/glm-5.3-flash quantization fp8 → fp4
provider price changes
- Baidu: deepseek/deepseek-v4-flash prompt price $0.084/M → $0.08/M (−4.0%)
- Baidu: deepseek/deepseek-v4-flash completion price $0.167/M → $0.16/M (−4.0%)
- Mancer 2: deepseek/deepseek-v4-flash prompt price $0.165/M → $0.17/M (+3.0%)
- StreamLake: deepseek/deepseek-v4-flash prompt price $0.084/M → $0.08/M (−4.3%)
- StreamLake: deepseek/deepseek-v4-flash completion price $0.167/M → $0.16/M (−4.3%)
- Mancer 2: deepseek/deepseek-v4-flash-0731 prompt price $0.165/M → $0.17/M (+3.0%)
- OpenInference: deepseek/deepseek-v4-flash-0731 completion price $0.1/M → $0.16/M (+60.0%)
- Phala: deepseek/deepseek-v4-flash-0731 prompt price $0.22/M → $0.44/M (+100.0%)
- Phala: deepseek/deepseek-v4-flash-0731 completion price $0.66/M → $1.32/M (+100.0%)
- Relace: deepseek/deepseek-v4-flash-0731 prompt price $0.045/M → $0.065/M (+44.4%)
- Relace: deepseek/deepseek-v4-flash-0731 completion price $0.09/M → $0.18/M (+100.0%)
- Baidu: deepseek/deepseek-v4-pro prompt price $0.639/M → $0.446/M (−30.2%)
- Baidu: deepseek/deepseek-v4-pro completion price $1.28/M → $0.892/M (−30.2%)
2026-08-29 119 change(s)
added to the catalog
- DeepSeek: DeepSeek V4 Flash 0731 (batch) (deepseek/deepseek-v4-flash-0731:batch) added to the catalog: 1,048,576 ctx, $0.14/M in / $0.28/M out
- DeepSeek: DeepSeek V4 Pro 0813 (batch) (deepseek/deepseek-v4-pro-0813:batch) added to the catalog: 1,048,576 ctx, $1.32/M in / $3.96/M out
- Google: Gemma 4 31B (batch) (google/gemma-4-31b-it:batch) added to the catalog: 262,144 ctx, $0.39/M in / $0.97/M out
- Meta: Muse Glimmer 30B (batch) (meta/muse-glimmer-30b:batch) added to the catalog: 131,072 ctx, $0.35/M in / $1.5/M out
- MoonshotAI: Kimi K3 (batch) (moonshotai/kimi-k3:batch) added to the catalog: 1,048,576 ctx, $3/M in / $15/M out
- OpenAI: gpt-oss-120b (batch) (openai/gpt-oss-120b:batch) added to the catalog: 131,072 ctx, $0.15/M in / $0.6/M out
- OpenAI: gpt-oss-20b (batch) (openai/gpt-oss-20b:batch) added to the catalog: 131,072 ctx, $0.05/M in / $0.2/M out
- Qwen: Qwen3.5-9B (batch) (qwen/qwen3.5-9b:batch) added to the catalog: 262,144 ctx, $0.17/M in / $0.25/M out
- Thinking Machines: Inkling Small (batch) (thinkingmachines/inkling-small:batch) added to the catalog: 524,288 ctx, $0.5/M in / $1.2/M out
- Z.ai: GLM 5.3 Flash (batch) (z-ai/glm-5.3-flash:batch) added to the catalog: 1,048,575 ctx, $0.15/M in / $0.5/M out
removed from the catalog
- AllenAI: Olmo 3 32B Think (allenai/olmo-3-32b-think) removed from the catalog
- Arcee AI: Virtuoso Large (arcee-ai/virtuoso-large) removed from the catalog
model price changes
- ~google/gemini-flash-latest: prompt price $0.375/M → $0.75/M (+100.0%)
- ~google/gemini-flash-latest: completion price $1.88/M → $3.75/M (+100.0%)
- ~z-ai/glm-latest: prompt price $1.25/M → $1.2/M (−4.0%)
- ~z-ai/glm-latest: completion price $4.4/M → $4/M (−9.1%)
- deepseek/deepseek-v4-flash: prompt price $0.087/M → $0.084/M (−3.5%)
- deepseek/deepseek-v4-flash: completion price $0.174/M → $0.167/M (−3.5%)
- deepseek/deepseek-v4-flash-0731: prompt price $0.06/M → $0.045/M (−25.0%)
- deepseek/deepseek-v4-flash-0731: completion price $0.12/M → $0.09/M (−25.0%)
- deepseek/deepseek-v4-pro: prompt price $0.762/M → $0.63/M (−17.3%)
- deepseek/deepseek-v4-pro: completion price $1.52/M → $1.26/M (−17.3%)
- google/gemini-3.7-flash: prompt price $0.375/M → $0.75/M (+100.0%)
- google/gemini-3.7-flash: completion price $1.88/M → $3.75/M (+100.0%)
- meta/muse-glimmer-30b: prompt price $0.35/M → $0.3/M (−14.3%)
- meta/muse-glimmer-30b: completion price $1.5/M → $1.2/M (−20.0%)
- nvidia/nemotron-3.5-lightning: prompt price $0.1/M → $0.08/M (−20.0%)
- nvidia/nemotron-3.5-lightning: completion price $0.25/M → $0.2/M (−20.0%)
- qwen/qwen3-vl-30b-a3b-instruct: prompt price $0.13/M → $0.15/M (+15.4%)
- qwen/qwen3-vl-30b-a3b-instruct: completion price $0.52/M → $0.6/M (+15.4%)
2026-08-28 150 change(s)
added to the catalog
- Mistral: Codestral 2508 (batch) (mistralai/codestral-2508:batch) added to the catalog: 256,000 ctx, $0.3/M in / $0.9/M out
- Mistral: Ministral 3 8B 2512 (batch) (mistralai/ministral-8b-2512:batch) added to the catalog: 262,144 ctx, $0.15/M in / $0.15/M out
- Mistral: Mistral Large 3 2512 (batch) (mistralai/mistral-large-2512:batch) added to the catalog: 262,144 ctx, $0.5/M in / $1.5/M out
- Mistral: Mistral Medium 3.5 (batch) (mistralai/mistral-medium-3-5:batch) added to the catalog: 262,144 ctx, $0.75/M in / $3.75/M out
- Mistral: Mistral Medium 3.1 (batch) (mistralai/mistral-medium-3.1:batch) added to the catalog: 131,072 ctx, $0.4/M in / $2/M out
- Mistral: Mistral Small 4 (batch) (mistralai/mistral-small-2603:batch) added to the catalog: 262,144 ctx, $0.15/M in / $0.6/M out
- Qwen: Qwen3.8 2.4T A95B (batch) (qwen/qwen3.8-2.4t-a95b:batch) added to the catalog: 1,010,000 ctx, $2/M in / $6/M out
- Tencent: Hy4 preview (tencent/hy4-preview) added to the catalog: 1,048,576 ctx, $0.834/M in / $2.5/M out
removed from the catalog
- Mistral: Ministral 8B (mistralai/ministral-8b) removed from the catalog
- MoonshotAI: Kimi K2.7 Code (batch) (moonshotai/kimi-k2.7-code:batch) removed from the catalog
- OpenAI: GPT-3.5 Turbo (batch) (openai/gpt-3.5-turbo:batch) removed from the catalog
- OpenAI: GPT-4 Turbo (batch) (openai/gpt-4-turbo:batch) removed from the catalog
- OpenAI: GPT-4.1 Mini (batch) (openai/gpt-4.1-mini:batch) removed from the catalog
- OpenAI: GPT-4.1 Nano (batch) (openai/gpt-4.1-nano:batch) removed from the catalog
- OpenAI: GPT-4.1 (batch) (openai/gpt-4.1:batch) removed from the catalog
- OpenAI: GPT-4o-mini (batch) (openai/gpt-4o-mini:batch) removed from the catalog
- OpenAI: GPT-4o (batch) (openai/gpt-4o:batch) removed from the catalog
- OpenAI: GPT-5 Codex (batch) (openai/gpt-5-codex:batch) removed from the catalog
- OpenAI: GPT-5 Mini (batch) (openai/gpt-5-mini:batch) removed from the catalog
- OpenAI: GPT-5 Nano (batch) (openai/gpt-5-nano:batch) removed from the catalog
- OpenAI: GPT-5 Pro (batch) (openai/gpt-5-pro:batch) removed from the catalog
- OpenAI: GPT-5 (batch) (openai/gpt-5:batch) removed from the catalog
- OpenAI: GPT-5.1 (batch) (openai/gpt-5.1:batch) removed from the catalog
- OpenAI: GPT-5.2 Pro (batch) (openai/gpt-5.2-pro:batch) removed from the catalog
- OpenAI: GPT-5.2 (batch) (openai/gpt-5.2:batch) removed from the catalog
- OpenAI: GPT-5.4 Mini (batch) (openai/gpt-5.4-mini:batch) removed from the catalog
- OpenAI: GPT-5.4 Nano (batch) (openai/gpt-5.4-nano:batch) removed from the catalog
- OpenAI: GPT-5.4 Pro (batch) (openai/gpt-5.4-pro:batch) removed from the catalog
- OpenAI: GPT-5.4 (batch) (openai/gpt-5.4:batch) removed from the catalog
- OpenAI: GPT-5.5 Pro (batch) (openai/gpt-5.5-pro:batch) removed from the catalog
2026-08-27 93 change(s)
added to the catalog
- Ling 3.0 Flash Fin (free) (inclusionai/ling-3.0-flash-fin:free) added to the catalog: 262,144 ctx, $0/M in / $0/M out
- Qwen: Qwen3.8 Flash (qwen/qwen3.8-flash) added to the catalog: 1,000,000 ctx, $0.15/M in / $0.47/M out
- Z.ai: GLM 5.3 Flash (z-ai/glm-5.3-flash) added to the catalog: 1,310,720 ctx, $0.075/M in / $0.25/M out
removed from the catalog
- Ox Alpha (stealth/ox-alpha) removed from the catalog
- Z.ai: GLM 5.2 (batch) (z-ai/glm-5.2:batch) removed from the catalog
model price changes
- ~deepseek/deepseek-v4-flash-latest: completion price $0.075/M → $0.1/M (+33.3%)
- deepseek/deepseek-v4-flash: prompt price $0.089/M → $0.078/M (−12.0%)
- deepseek/deepseek-v4-flash: completion price $0.177/M → $0.156/M (−12.0%)
- moonshotai/kimi-k2.7-code: prompt price $0.67/M → $0.66/M (−1.5%)
- qwen/qwen3-235b-a22b-2507: prompt price $0.09/M → $0.087/M (−2.8%)
- qwen/qwen3-235b-a22b-2507: completion price $0.55/M → $0.35/M (−36.4%)
- qwen/qwen3.6-35b-a3b: prompt price $0.14/M → $0.1/M (−28.6%)
- qwen/qwen3.6-35b-a3b: completion price $1/M → $0.9/M (−10.0%)
- tencent/hy3: prompt price $0.132/M → $0.083/M (−37.5%)
- tencent/hy3: completion price $0.528/M → $0.33/M (−37.5%)
- z-ai/glm-4.6: prompt price $0.5/M → $0.43/M (−14.0%)
- z-ai/glm-4.6: completion price $2/M → $1.75/M (−12.5%)
quantization changes
- DeepInfra: xiaomi/mimo-v2.5 quantization bf16 → fp8
provider price changes
- Baidu: deepseek/deepseek-v4-flash prompt price $0.14/M → $0.079/M (−43.3%)
- Baidu: deepseek/deepseek-v4-flash completion price $0.28/M → $0.159/M (−43.3%)
- Mancer 2: deepseek/deepseek-v4-flash prompt price $0.14/M → $0.15/M (+7.1%)
- StreamLake: deepseek/deepseek-v4-flash prompt price $0.089/M → $0.078/M (−12.0%)
- StreamLake: deepseek/deepseek-v4-flash completion price $0.177/M → $0.156/M (−12.0%)
- Alibaba: deepseek/deepseek-v4-flash-0731 prompt price $0.352/M → $0.176/M (−50.0%)
- Alibaba: deepseek/deepseek-v4-flash-0731 completion price $1.06/M → $0.528/M (−50.0%)
- Baidu: deepseek/deepseek-v4-flash-0731 prompt price $0.14/M → $0.06/M (−57.2%)
- Baidu: deepseek/deepseek-v4-flash-0731 completion price $0.28/M → $0.12/M (−57.2%)
- Mancer 2: deepseek/deepseek-v4-flash-0731 prompt price $0.155/M → $0.15/M (−3.2%)
- Morph: deepseek/deepseek-v4-flash-0731 prompt price $0.079/M → $0.099/M (+25.0%)
- OpenInference: deepseek/deepseek-v4-flash-0731 completion price $0.075/M → $0.1/M (+33.3%)
2026-08-26 71 change(s)
added to the catalog
- MiniMax: MiniMax M3 (free) (minimax/minimax-m3:free) added to the catalog: 1,048,576 ctx, $0/M in / $0/M out
removed from the catalog
- Google: Gemma 3n 4B (google/gemma-3n-e4b-it) removed from the catalog
- Qwen: Qwen Plus 0728 (thinking) (qwen/qwen-plus-2025-07-28:thinking) removed from the catalog
model price changes
- ~deepseek/deepseek-v4-flash-latest: prompt price $0.035/M → $0.03/M (−14.3%)
- ~moonshotai/kimi-latest: prompt price $2.8/M → $2.55/M (−8.9%)
- ~moonshotai/kimi-latest: completion price $14/M → $12.8/M (−8.9%)
- deepseek/deepseek-v4-flash-0731: prompt price $0.14/M → $0.06/M (−57.1%)
- deepseek/deepseek-v4-flash-0731: completion price $0.28/M → $0.12/M (−57.1%)
- deepseek/deepseek-v4-pro: prompt price $0.79/M → $0.87/M (+10.1%)
- deepseek/deepseek-v4-pro: completion price $1.58/M → $1.74/M (+10.1%)
- google/gemma-4-31b-it: prompt price $0.1/M → $0.09/M (−10.0%)
- meta-llama/llama-3.3-70b-instruct: prompt price $0.1/M → $0.71/M (+610.0%)
- meta-llama/llama-3.3-70b-instruct: completion price $0.32/M → $0.71/M (+121.9%)
- meta-llama/llama-4-scout: prompt price $0.1/M → $0.11/M (+10.0%)
- meta-llama/llama-4-scout: completion price $0.3/M → $0.34/M (+13.3%)
- qwen/qwen2.5-vl-72b-instruct: prompt price $0.8/M → $0.25/M (−68.8%)
- qwen/qwen2.5-vl-72b-instruct: completion price $1/M → $0.75/M (−25.0%)
- qwen/qwen3.5-397b-a17b: prompt price $0.5/M → $0.39/M (−22.0%)
- qwen/qwen3.5-397b-a17b: completion price $3.6/M → $2.34/M (−35.0%)
- qwen/qwen3.6-27b: prompt price $0.32/M → $0.6/M (+87.5%)
- qwen/qwen3.6-27b: completion price $3.2/M → $3.6/M (+12.5%)
- qwen/qwen3.8-27b: prompt price $0.4/M → $0.425/M (+6.3%)
- qwen/qwen3.8-27b: completion price $3/M → $2.55/M (−15.0%)
model context changes
- meta-llama/llama-guard-4-12b: context length 1,048,576 → 163,840
quantization changes
- GMICloud: deepseek/deepseek-v4-flash-0731 quantization fp4 → fp8
- Io Net: z-ai/glm-5.2 quantization fp8 → fp4
provider price changes
- Mancer 2: deepseek/deepseek-v4-flash-0731 prompt price $0.15/M → $0.155/M (+3.3%)
- OpenInference: deepseek/deepseek-v4-flash-0731 prompt price $0.035/M → $0.03/M (−14.3%)
- Relace: deepseek/deepseek-v4-flash-0731 prompt price $0.04/M → $0.06/M (+50.0%)
- Relace: deepseek/deepseek-v4-flash-0731 completion price $0.08/M → $0.12/M (+50.0%)
2026-08-25 101 change(s)
added to the catalog
- MiniMax: MiniMax M2.7 (free) (minimax/minimax-m2.7:free) added to the catalog: 196,608 ctx, $0/M in / $0/M out
- Mistral: Devstral 2 2512 (mistralai/devstral-2512) added to the catalog: 262,144 ctx, $0.44/M in / $2.2/M out
removed from the catalog
- inclusionAI: Ling-2.6-1T (inclusionai/ling-2.6-1t) removed from the catalog
- inclusionAI: Ling-2.6-flash (inclusionai/ling-2.6-flash) removed from the catalog
- inclusionAI: Ring-2.6-1T (inclusionai/ring-2.6-1t) removed from the catalog
- NVIDIA: Nemotron 3 Nano 30B A3B (free) (nvidia/nemotron-3-nano-30b-a3b:free) removed from the catalog
- NVIDIA: Nemotron Nano 12B 2 VL (free) (nvidia/nemotron-nano-12b-v2-vl:free) removed from the catalog
- NVIDIA: Nemotron Nano 9B V2 (free) (nvidia/nemotron-nano-9b-v2:free) removed from the catalog
model price changes
- ~deepseek/deepseek-v4-flash-latest: prompt price $0.04/M → $0.035/M (−12.5%)
- ~deepseek/deepseek-v4-flash-latest: completion price $0.08/M → $0.075/M (−6.3%)
- ~moonshotai/kimi-latest: prompt price $2.6/M → $2.8/M (+7.7%)
- ~moonshotai/kimi-latest: completion price $13/M → $14/M (+7.7%)
- deepseek/deepseek-v4-flash: prompt price $0.057/M → $0.089/M (+54.4%)
- deepseek/deepseek-v4-flash: completion price $0.115/M → $0.177/M (+54.4%)
- deepseek/deepseek-v4-pro: prompt price $0.526/M → $0.79/M (+50.2%)
- deepseek/deepseek-v4-pro: completion price $1.05/M → $1.58/M (+50.2%)
- minimax/minimax-m2.7: prompt price $0.24/M → $0.3/M (+25.0%)
- minimax/minimax-m2.7: completion price $0.96/M → $1.2/M (+25.0%)
- moonshotai/kimi-k2.5: prompt price $0.45/M → $0.6/M (+33.3%)
- moonshotai/kimi-k2.5: completion price $2.25/M → $3/M (+33.3%)
- thinkingmachines/inkling: prompt price $1/M → $0.95/M (−5.0%)
- z-ai/glm-5.1: prompt price $0.966/M → $1.26/M (+30.4%)
- z-ai/glm-5.1: completion price $3.04/M → $3.96/M (+30.4%)
- z-ai/glm-5.2: prompt price $0.966/M → $1.19/M (+23.2%)
- z-ai/glm-5.2: completion price $3.04/M → $3.74/M (+23.2%)
model context changes
- qwen/qwen3-235b-a22b-thinking-2507: context length 262,144 → 131,072
- thinkingmachines/inkling-small:free: context length 262,144 → 1,048,576
- thinkingmachines/inkling:free: context length 262,144 → 1,048,576
quantization changes
- GMICloud: deepseek/deepseek-v4-flash-0731 quantization fp8 → fp4
- CoreWeave: google/gemma-4-31b-it quantization bf16 → fp4
2026-08-24 50 change(s)
model price changes
- ~deepseek/deepseek-v4-flash-latest: prompt price $0.055/M → $0.04/M (−27.3%)
- ~deepseek/deepseek-v4-flash-latest: completion price $0.14/M → $0.08/M (−42.9%)
- deepseek/deepseek-v4-flash: prompt price $0.053/M → $0.057/M (+8.2%)
- deepseek/deepseek-v4-flash: completion price $0.106/M → $0.115/M (+8.2%)
- deepseek/deepseek-v4-flash-0731: prompt price $0.08/M → $0.14/M (+75.0%)
- deepseek/deepseek-v4-flash-0731: completion price $0.18/M → $0.28/M (+55.6%)
- deepseek/deepseek-v4-pro: prompt price $0.397/M → $0.526/M (+32.6%)
- deepseek/deepseek-v4-pro: completion price $0.794/M → $1.05/M (+32.6%)
- minimax/minimax-m2.7: prompt price $0.3/M → $0.24/M (−20.0%)
- minimax/minimax-m2.7: completion price $1.2/M → $0.96/M (−20.0%)
- qwen/qwen3.5-397b-a17b: prompt price $0.39/M → $0.5/M (+28.2%)
- qwen/qwen3.5-397b-a17b: completion price $2.34/M → $3.6/M (+53.8%)
- qwen/qwen3.6-27b: prompt price $0.6/M → $0.32/M (−46.7%)
- qwen/qwen3.6-27b: completion price $3.6/M → $3.2/M (−11.1%)
provider price changes
- Baidu: deepseek/deepseek-v4-flash prompt price $0.053/M → $0.14/M (+163.2%)
- Baidu: deepseek/deepseek-v4-flash completion price $0.106/M → $0.28/M (+163.2%)
- Mancer 2: deepseek/deepseek-v4-flash prompt price $0.145/M → $0.14/M (−3.4%)
- StreamLake: deepseek/deepseek-v4-flash prompt price $0.053/M → $0.057/M (+8.2%)
- StreamLake: deepseek/deepseek-v4-flash completion price $0.106/M → $0.115/M (+8.2%)
- Baidu: deepseek/deepseek-v4-flash-0731 prompt price $0.066/M → $0.14/M (+112.8%)
- Baidu: deepseek/deepseek-v4-flash-0731 completion price $0.132/M → $0.28/M (+112.8%)
- Io Net: deepseek/deepseek-v4-flash-0731 prompt price $0.249/M → $0.219/M (−12.0%)
- Io Net: deepseek/deepseek-v4-flash-0731 completion price $0.69/M → $0.49/M (−29.0%)
- Mancer 2: deepseek/deepseek-v4-flash-0731 prompt price $0.145/M → $0.14/M (−3.4%)
- Morph: deepseek/deepseek-v4-flash-0731 prompt price $0.12/M → $0.079/M (−34.2%)
- OpenInference: deepseek/deepseek-v4-flash-0731 prompt price $0.05/M → $0.04/M (−20.0%)
- Relace: deepseek/deepseek-v4-flash-0731 prompt price $0.07/M → $0.04/M (−42.9%)
- Relace: deepseek/deepseek-v4-flash-0731 completion price $0.14/M → $0.08/M (−42.9%)
- StreamLake: deepseek/deepseek-v4-flash-0731 prompt price $0.066/M → $0.207/M (+215.0%)
- StreamLake: deepseek/deepseek-v4-flash-0731 completion price $0.131/M → $0.15/M (+14.5%)
2026-08-23 64 change(s)
added to the catalog
- Tencent: Hy-MT2-7B (tencent/hy-mt2-7b) added to the catalog: 8,192 ctx, $0.074/M in / $0.295/M out
model price changes
- ~deepseek/deepseek-v4-flash-latest: prompt price $0.065/M → $0.055/M (−15.4%)
- ~deepseek/deepseek-v4-flash-latest: completion price $0.18/M → $0.14/M (−22.2%)
- deepseek/deepseek-v4-flash: prompt price $0.074/M → $0.053/M (−28.4%)
- deepseek/deepseek-v4-flash: completion price $0.148/M → $0.106/M (−28.4%)
- deepseek/deepseek-v4-pro: prompt price $0.481/M → $0.397/M (−17.6%)
- deepseek/deepseek-v4-pro: completion price $0.963/M → $0.794/M (−17.6%)
- deepseek/deepseek-v4-pro-0813: prompt price $1.19/M → $1.12/M (−5.6%)
- deepseek/deepseek-v4-pro-0813: completion price $3.56/M → $3.37/M (−5.6%)
- meta/muse-glimmer-30b: prompt price $0.3/M → $0.35/M (+16.7%)
- meta/muse-glimmer-30b: completion price $1.1/M → $1.5/M (+36.4%)
- moonshotai/kimi-k2.6: prompt price $0.541/M → $0.95/M (+75.4%)
- moonshotai/kimi-k2.6: completion price $2.28/M → $4/M (+75.4%)
- openai/gpt-oss-120b: prompt price $0.03/M → $0.037/M (+23.3%)
- qwen/qwen3-30b-a3b: prompt price $0.13/M → $0.12/M (−7.7%)
- qwen/qwen3-30b-a3b: completion price $0.52/M → $0.5/M (−3.8%)
- qwen/qwen3.8-27b: prompt price $0.45/M → $0.4/M (−11.1%)
- qwen/qwen3.8-27b: completion price $3.2/M → $3/M (−6.2%)
- thinkingmachines/inkling: prompt price $0.95/M → $1/M (+5.3%)
provider price changes
- Baidu: deepseek/deepseek-v4-flash prompt price $0.074/M → $0.053/M (−28.3%)
- Baidu: deepseek/deepseek-v4-flash completion price $0.148/M → $0.106/M (−28.3%)
- GMICloud: deepseek/deepseek-v4-flash prompt price $0.084/M → $0.059/M (−30.0%)
- GMICloud: deepseek/deepseek-v4-flash completion price $0.168/M → $0.118/M (−30.0%)
- Mancer 2: deepseek/deepseek-v4-flash prompt price $0.14/M → $0.145/M (+3.6%)
- StreamLake: deepseek/deepseek-v4-flash prompt price $0.074/M → $0.053/M (−28.4%)
- StreamLake: deepseek/deepseek-v4-flash completion price $0.148/M → $0.106/M (−28.4%)
- Baidu: deepseek/deepseek-v4-flash-0731 prompt price $0.069/M → $0.066/M (−4.1%)
- Baidu: deepseek/deepseek-v4-flash-0731 completion price $0.137/M → $0.132/M (−4.1%)
- Decart: deepseek/deepseek-v4-flash-0731 prompt price $0.068/M → $0.064/M (−5.3%)
- Decart: deepseek/deepseek-v4-flash-0731 completion price $0.135/M → $0.128/M (−5.3%)
2026-08-22 98 change(s)
added to the catalog
- DeepSeek: DeepSeek V4 Flash Vision Exp (deepseek/deepseek-v4-flash-vision-exp) added to the catalog: 1,048,576 ctx, $0.22/M in / $0.66/M out
- Meta: Muse Spark 1.2 Contributor (meta/muse-spark-1.2-contributor) added to the catalog: 1,048,576 ctx, $0.1/M in / $0.2/M out
- Thinking Machines: Inkling Small (free) (thinkingmachines/inkling-small:free) added to the catalog: 262,144 ctx, $0/M in / $0/M out
- Thinking Machines: Inkling (free) (thinkingmachines/inkling:free) added to the catalog: 262,144 ctx, $0/M in / $0/M out
removed from the catalog
- Deep Cogito: Cogito v2.1 671B (deepcogito/cogito-v2.1-671b) removed from the catalog
- OpenAI: gpt-oss-20b (free) (openai/gpt-oss-20b:free) removed from the catalog
model price changes
- ~deepseek/deepseek-v4-flash-latest: completion price $0.14/M → $0.18/M (+28.6%)
- ~openai/gpt-latest: prompt price $2.5/M → $2/M (−20.0%)
- ~openai/gpt-latest: completion price $15/M → $10/M (−33.3%)
- deepseek/deepseek-chat-v3.1: prompt price $0.25/M → $0.55/M (+120.0%)
- deepseek/deepseek-chat-v3.1: completion price $0.95/M → $1.65/M (+73.7%)
- deepseek/deepseek-v3.2: prompt price $0.269/M → $0.26/M (−3.3%)
- deepseek/deepseek-v3.2: completion price $0.4/M → $0.38/M (−5.0%)
- deepseek/deepseek-v4-flash: prompt price $0.083/M → $0.074/M (−10.3%)
- deepseek/deepseek-v4-flash: completion price $0.165/M → $0.148/M (−10.3%)
- deepseek/deepseek-v4-flash-0731: prompt price $0.14/M → $0.08/M (−42.9%)
- deepseek/deepseek-v4-flash-0731: completion price $0.28/M → $0.18/M (−35.7%)
- deepseek/deepseek-v4-pro: prompt price $1.6/M → $0.481/M (−69.9%)
- deepseek/deepseek-v4-pro: completion price $3.2/M → $0.963/M (−69.9%)
- minimax/minimax-m2.5: completion price $0.95/M → $1.08/M (+13.7%)
- mistralai/mistral-small-3.2-24b-instruct: prompt price $0.094/M → $0.075/M (−20.0%)
- mistralai/mistral-small-3.2-24b-instruct: completion price $0.25/M → $0.2/M (−20.0%)
- moonshotai/kimi-k2.6: prompt price $0.95/M → $0.541/M (−43.0%)
- moonshotai/kimi-k2.6: completion price $4/M → $2.28/M (−43.0%)
- openai/gpt-5.6-sol: prompt price $2.5/M → $2/M (−20.0%)
- openai/gpt-5.6-sol: completion price $15/M → $10/M (−33.3%)
- openai/gpt-5.6-sol-pro: prompt price $2.5/M → $2/M (−20.0%)
- openai/gpt-5.6-sol-pro: completion price $15/M → $10/M (−33.3%)
- openai/gpt-5.6-sol-pro:batch: prompt price $1.25/M → $1/M (−20.0%)
- openai/gpt-5.6-sol-pro:batch: completion price $7.5/M → $5/M (−33.3%)
2026-08-21 83 change(s)
added to the catalog
- Mancer: Weaver (alpha) (mancer/weaver) added to the catalog: 8,000 ctx, $0.5/M in / $0.75/M out
- Mistral: Ministral 8B (mistralai/ministral-8b) added to the catalog: 128,000 ctx, $0.11/M in / $0.11/M out
- Ox Alpha (stealth/ox-alpha) added to the catalog: 1,048,576 ctx, $0/M in / $0/M out
- Tencent: Hy-MT2-1.8B (tencent/hy-mt2-1.8b) added to the catalog: 8,192 ctx, $0.044/M in / $0.177/M out
- Tencent: Hy-MT2-30B-A3B (tencent/hy-mt2-30b-a3b) added to the catalog: 8,192 ctx, $0.074/M in / $0.295/M out
model price changes
- deepseek/deepseek-v4-flash: prompt price $0.089/M → $0.083/M (−6.8%)
- deepseek/deepseek-v4-flash: completion price $0.177/M → $0.165/M (−6.8%)
- deepseek/deepseek-v4-pro: prompt price $1.44/M → $1.6/M (+11.1%)
- deepseek/deepseek-v4-pro: completion price $2.88/M → $3.2/M (+11.1%)
- google/gemma-4-31b-it: prompt price $0.09/M → $0.1/M (+11.1%)
- meta/muse-glimmer-30b: prompt price $0.35/M → $0.3/M (−14.3%)
- meta/muse-glimmer-30b: completion price $1.5/M → $1.1/M (−26.7%)
- minimax/minimax-m2.5: prompt price $0.225/M → $0.27/M (+20.0%)
- minimax/minimax-m2.5: completion price $0.9/M → $0.95/M (+5.6%)
- moonshotai/kimi-k2.7-code: prompt price $0.71/M → $0.67/M (−5.6%)
- moonshotai/kimi-k2.7-code: completion price $3.5/M → $3.4/M (−2.9%)
- qwen/qwen3-14b: prompt price $0.12/M → $0.227/M (+89.6%)
- qwen/qwen3-14b: completion price $0.24/M → $0.91/M (+279.2%)
model context changes
- liquid/lfm-2.5-2.6b:free: context length 128,000 → 65,536
- nvidia/nemotron-3.5-lightning: context length 1,000,000 → 262,144
- thinkingmachines/inkling-small: context length 524,288 → 1,048,576
- z-ai/glm-5.2:batch: context length 512,000 → 1,048,575
provider price changes
- GMICloud: deepseek/deepseek-v4-flash prompt price $0.112/M → $0.084/M (−25.0%)
- GMICloud: deepseek/deepseek-v4-flash completion price $0.224/M → $0.168/M (−25.0%)
- Mancer 2: deepseek/deepseek-v4-flash prompt price $0.145/M → $0.14/M (−3.4%)
- StreamLake: deepseek/deepseek-v4-flash prompt price $0.089/M → $0.083/M (−6.8%)
- StreamLake: deepseek/deepseek-v4-flash completion price $0.177/M → $0.165/M (−6.8%)
- Ambient: deepseek/deepseek-v4-flash-0731 prompt price $0.14/M → $0.08/M (−42.9%)
- Ambient: deepseek/deepseek-v4-flash-0731 completion price $0.28/M → $0.18/M (−35.7%)
- AtlasCloud: deepseek/deepseek-v4-flash-0731 prompt price $0.14/M → $0.44/M (+214.3%)
2026-08-20 64 change(s)
added to the catalog
- Z.ai: GLM Latest (~z-ai/glm-latest) added to the catalog: 1,048,576 ctx, $1.4/M in / $4.4/M out
removed from the catalog
- AI21: Jamba Large 1.7 (ai21/jamba-large-1.7) removed from the catalog
- Mancer: Weaver (alpha) (mancer/weaver) removed from the catalog
model price changes
- ~deepseek/deepseek-v4-flash-latest: prompt price $0.076/M → $0.065/M (−15.0%)
- ~deepseek/deepseek-v4-flash-latest: completion price $0.153/M → $0.14/M (−8.5%)
- deepseek/deepseek-chat-v3-0324: prompt price $0.27/M → $0.25/M (−7.4%)
- deepseek/deepseek-chat-v3-0324: completion price $1.12/M → $1/M (−10.7%)
- deepseek/deepseek-v4-flash: prompt price $0.083/M → $0.089/M (+7.3%)
- deepseek/deepseek-v4-flash: completion price $0.165/M → $0.177/M (+7.3%)
- deepseek/deepseek-v4-pro: prompt price $0.66/M → $1.44/M (+118.2%)
- deepseek/deepseek-v4-pro: completion price $1.98/M → $2.88/M (+45.5%)
- deepseek/deepseek-v4-pro-0813: prompt price $0.66/M → $1.19/M (+80.0%)
- deepseek/deepseek-v4-pro-0813: completion price $1.98/M → $3.56/M (+80.0%)
- minimax/minimax-m2.5: prompt price $0.22/M → $0.225/M (+2.3%)
- qwen/qwen3.5-35b-a3b: prompt price $0.225/M → $0.25/M (+11.1%)
- qwen/qwen3.5-35b-a3b: completion price $1.8/M → $1.25/M (−30.6%)
- qwen/qwen3.6-27b: prompt price $0.3/M → $0.6/M (+100.0%)
- qwen/qwen3.6-27b: completion price $2/M → $3.6/M (+80.0%)
model context changes
- qwen/qwen3.8-27b: context length 262,144 → 1,000,000
provider price changes
- GMICloud: deepseek/deepseek-v4-flash prompt price $0.084/M → $0.112/M (+33.3%)
- GMICloud: deepseek/deepseek-v4-flash completion price $0.168/M → $0.224/M (+33.3%)
- StreamLake: deepseek/deepseek-v4-flash prompt price $0.083/M → $0.089/M (+7.3%)
- StreamLake: deepseek/deepseek-v4-flash completion price $0.165/M → $0.177/M (+7.3%)
- Cloudflare: deepseek/deepseek-v4-flash-0731 prompt price $0.44/M → $0.08/M (−81.8%)
- Cloudflare: deepseek/deepseek-v4-flash-0731 completion price $1.32/M → $0.18/M (−86.4%)
- OpenInference: deepseek/deepseek-v4-flash-0731 prompt price $0.08/M → $0.065/M (−18.8%)
- OpenInference: deepseek/deepseek-v4-flash-0731 completion price $0.18/M → $0.14/M (−22.2%)
- Relace: deepseek/deepseek-v4-flash-0731 prompt price $0.105/M → $0.07/M (−33.3%)
- Relace: deepseek/deepseek-v4-flash-0731 completion price $0.21/M → $0.14/M (−33.3%)
- Sail Research: deepseek/deepseek-v4-flash-0731 prompt price $0.09/M → $0.065/M (−27.8%)
2026-08-19 57 change(s)
added to the catalog
- LiquidAI: LFM2.5-2.6B (free) (liquid/lfm-2.5-2.6b:free) added to the catalog: 128,000 ctx, $0/M in / $0/M out
- Z.ai: GLM 5.3 (z-ai/glm-5.3) added to the catalog: 1,048,576 ctx, $1.4/M in / $4.4/M out
model price changes
- ~deepseek/deepseek-v4-flash-latest: prompt price $0.079/M → $0.076/M (−2.7%)
- ~deepseek/deepseek-v4-flash-latest: completion price $0.157/M → $0.153/M (−2.7%)
- google/gemma-4-31b-it: prompt price $0.1/M → $0.09/M (−10.0%)
- minimax/minimax-m3:batch: prompt price $0.15/M → $0.3/M (+100.0%)
- minimax/minimax-m3:batch: completion price $0.6/M → $1.2/M (+100.0%)
- moonshotai/kimi-k2.5: prompt price $0.57/M → $0.45/M (−21.1%)
- moonshotai/kimi-k2.5: completion price $2.85/M → $2.25/M (−21.1%)
- moonshotai/kimi-k2.7-code:batch: prompt price $0.475/M → $0.95/M (+100.0%)
- moonshotai/kimi-k2.7-code:batch: completion price $2/M → $4/M (+100.0%)
- nvidia/nemotron-3-ultra-550b-a55b:batch: prompt price $0.3/M → $0.6/M (+100.0%)
- nvidia/nemotron-3-ultra-550b-a55b:batch: completion price $1.8/M → $3.6/M (+100.0%)
- qwen/qwen3-next-80b-a3b-instruct: prompt price $0.1/M → $0.09/M (−10.0%)
- qwen/qwen3.5-122b-a10b: prompt price $0.29/M → $0.26/M (−10.3%)
- qwen/qwen3.5-122b-a10b: completion price $2.4/M → $2.08/M (−13.3%)
- qwen/qwen3.6-27b: prompt price $0.6/M → $0.3/M (−50.0%)
- qwen/qwen3.6-27b: completion price $3.6/M → $2/M (−44.4%)
- thinkingmachines/inkling:batch: prompt price $0.5/M → $1/M (+100.0%)
- thinkingmachines/inkling:batch: completion price $2.02/M → $4.05/M (+100.0%)
- z-ai/glm-5.2: prompt price $0.5/M → $0.966/M (+93.2%)
- z-ai/glm-5.2: completion price $3.15/M → $3.04/M (−3.6%)
- z-ai/glm-5.2:batch: prompt price $0.7/M → $1.4/M (+100.0%)
- z-ai/glm-5.2:batch: completion price $2.2/M → $4.4/M (+100.0%)
model context changes
- z-ai/glm-5.2:free: context length 128,000 → 256,000
quantization changes
- DeepSeek: deepseek/deepseek-v4-flash-0731 quantization fp8 → unknown
provider price changes
- Mancer 2: deepseek/deepseek-v4-flash prompt price $0.14/M → $0.145/M (+3.6%)
- Decart: deepseek/deepseek-v4-flash-0731 prompt price $0.079/M → $0.076/M (−3.4%)
- Decart: deepseek/deepseek-v4-flash-0731 completion price $0.158/M → $0.153/M (−3.4%)
- GMICloud: deepseek/deepseek-v4-flash-0731 prompt price $0.084/M → $0.112/M (+33.3%)
2026-08-18 116 change(s)
removed from the catalog
- LiquidAI: LFM2.5-2.6B (free) (liquid/lfm-2.5-2.6b:free) removed from the catalog
model price changes
- ~deepseek/deepseek-v4-flash-latest: prompt price $0.06/M → $0.079/M (+30.3%)
- ~deepseek/deepseek-v4-flash-latest: completion price $0.121/M → $0.157/M (+30.3%)
- ~openai/gpt-latest: prompt price $5/M → $2.5/M (−50.0%)
- ~openai/gpt-latest: completion price $30/M → $15/M (−50.0%)
- deepseek/deepseek-v3.1-terminus: completion price $0.95/M → $1/M (+5.3%)
- openai/gpt-5.6-luna: prompt price $0.1/M → $0.2/M (+100.0%)
- openai/gpt-5.6-luna: completion price $0.6/M → $1.2/M (+100.0%)
- openai/gpt-5.6-luna-pro: prompt price $0.1/M → $0.2/M (+100.0%)
- openai/gpt-5.6-luna-pro: completion price $0.6/M → $1.2/M (+100.0%)
- openai/gpt-5.6-sol: prompt price $5/M → $2.5/M (−50.0%)
- openai/gpt-5.6-sol: completion price $30/M → $15/M (−50.0%)
- openai/gpt-5.6-sol-pro: prompt price $5/M → $2.5/M (−50.0%)
- openai/gpt-5.6-sol-pro: completion price $30/M → $15/M (−50.0%)
- openai/gpt-5.6-sol-pro:batch: prompt price $2.5/M → $1.25/M (−50.0%)
- openai/gpt-5.6-sol-pro:batch: completion price $15/M → $7.5/M (−50.0%)
- openai/gpt-5.6-sol:batch: prompt price $2.5/M → $1.25/M (−50.0%)
- openai/gpt-5.6-sol:batch: completion price $15/M → $7.5/M (−50.0%)
- openai/gpt-5.6-terra: prompt price $1/M → $2/M (+100.0%)
- openai/gpt-5.6-terra: completion price $6/M → $12/M (+100.0%)
- openai/gpt-5.6-terra-pro: prompt price $1/M → $2/M (+100.0%)
- openai/gpt-5.6-terra-pro: completion price $6/M → $12/M (+100.0%)
- qwen/qwen3.6-27b: prompt price $0.289/M → $0.6/M (+107.6%)
- qwen/qwen3.6-27b: completion price $2.4/M → $3.6/M (+50.0%)
- z-ai/glm-4.6: prompt price $0.55/M → $0.5/M (−9.1%)
- z-ai/glm-4.6: completion price $2.2/M → $2/M (−9.1%)
- z-ai/glm-5.2: prompt price $1.19/M → $0.5/M (−58.0%)
- z-ai/glm-5.2: completion price $3.74/M → $3.15/M (−15.8%)
model context changes
- ~deepseek/deepseek-v4-flash-latest: context length 1,048,576 → 1,310,720
- deepseek/deepseek-v4-flash-0731: context length 1,048,576 → 1,310,720
2026-08-17 86 change(s)
added to the catalog
- Z.ai: GLM 5.2 (free) (z-ai/glm-5.2:free) added to the catalog: 128,000 ctx, $0/M in / $0/M out
model price changes
- ~deepseek/deepseek-v4-flash-latest: prompt price $0.067/M → $0.06/M (−10.1%)
- ~deepseek/deepseek-v4-flash-latest: completion price $0.134/M → $0.121/M (−10.1%)
- ~moonshotai/kimi-latest: prompt price $2.8/M → $2.6/M (−7.1%)
- ~moonshotai/kimi-latest: completion price $14/M → $13/M (−7.1%)
- deepseek/deepseek-v4-flash: prompt price $0.063/M → $0.083/M (+31.4%)
- deepseek/deepseek-v4-flash: completion price $0.126/M → $0.165/M (+31.4%)
- deepseek/deepseek-v4-pro: prompt price $1.17/M → $0.66/M (−43.5%)
- deepseek/deepseek-v4-pro: completion price $2.34/M → $1.98/M (−15.2%)
- deepseek/deepseek-v4-pro-0813: prompt price $0.435/M → $0.66/M (+51.7%)
- deepseek/deepseek-v4-pro-0813: completion price $0.87/M → $1.98/M (+127.6%)
- google/gemma-4-26b-a4b-it: prompt price $0.12/M → $0.07/M (−41.7%)
- google/gemma-4-26b-a4b-it: completion price $0.4/M → $0.34/M (−15.0%)
- minimax/minimax-m1: prompt price $0.4/M → $0.55/M (+37.5%)
- moonshotai/kimi-k2.6: prompt price $0.65/M → $0.95/M (+46.2%)
- moonshotai/kimi-k2.6: completion price $3.41/M → $4/M (+17.3%)
- nvidia/nemotron-3.5-lightning: prompt price $0.1/M → $0.08/M (−20.0%)
- nvidia/nemotron-3.5-lightning: completion price $0.25/M → $0.2/M (−20.0%)
- qwen/qwen2.5-vl-72b-instruct: prompt price $0.25/M → $0.8/M (+220.0%)
- qwen/qwen2.5-vl-72b-instruct: completion price $0.75/M → $1/M (+33.3%)
- qwen/qwen3-vl-235b-a22b-instruct: prompt price $0.26/M → $0.21/M (−19.2%)
- qwen/qwen3-vl-235b-a22b-instruct: completion price $1.04/M → $1.9/M (+82.7%)
- qwen/qwen3.6-27b: prompt price $0.3/M → $0.289/M (−3.7%)
- qwen/qwen3.6-27b: completion price $2/M → $2.4/M (+20.0%)
- qwen/qwen3.6-35b-a3b: prompt price $0.15/M → $0.14/M (−6.7%)
- z-ai/glm-5.2: prompt price $0.308/M → $1.19/M (+286.4%)
- z-ai/glm-5.2: completion price $0.968/M → $3.74/M (+286.4%)
quantization changes
- Mancer 2: deepseek/deepseek-v4-flash quantization fp4 → fp8
provider price changes
- GMICloud: deepseek/deepseek-v3.2 prompt price $0.215/M → $0.209/M (−2.7%)
- GMICloud: deepseek/deepseek-v3.2 completion price $0.318/M → $0.31/M (−2.7%)
$ curl variables.md — this site speaks markdown to your terminal.