Skip to content

v2026.9.4

Choose a tag to compare

@github-actions github-actions released this 04 Sep 07:08
· 34 commits to main since this release

What changed

New providers (1)

  • NaN (nan)

New models (39)

  • NanoGPT — Ornith 1.5 9B Thinking (ornith-ai/ornith-1.5-9b:thinking)
  • NanoGPT — Ornith 1.5 9B (ornith-ai/ornith-1.5-9b)
  • NanoGPT — Qwen 3.6 35B A3B Uncensored (qwen/qwen3.6-35b-a3b-uncensored)
  • NanoGPT — Qwen 3.6 35B A3B Uncensored Thinking (qwen/qwen3.6-35b-a3b-uncensored:thinking)
  • Deep Infra — DeepSeek V4 Flash Vision Exp (deepseek-ai/DeepSeek-V4-Flash-Vision-Exp)
  • Meta — Muse Spark 1.3 Contributor (muse-spark-1.3-contributor)
  • Meta — Muse Spark 1.3 (muse-spark-1.3)
  • Hugging Face — DeepSeek V4 Flash Vision Exp (deepseek-ai/DeepSeek-V4-Flash-Vision-Exp)
  • OpenRouter — Nemotron 3.5 Content Safety (nvidia/nemotron-3.5-content-safety)
  • OpenRouter — Ling 3.0 Flash Fin (inclusionai/ling-3.0-flash-fin)
  • CrossModel — Gemini 3.8 Flash (gemini/gemini-3.8-flash)
  • OpenCode Go — Omen Alpha (omen-alpha)
  • LLM Gateway — Qwen3.8 27B (Consensus Protocol) (consensusprotocol/Qwen3.8-27B)
  • LLM Gateway — Muse Spark 1.3 (Meta) (meta/muse-spark-1.3)
  • LLM Gateway — Muse Spark 1.3 Contributor (Meta Contributor) (meta-contributor/muse-spark-1.3-contributor)
  • Tinfoil — GLM-5.3-Flash (glm-5-3-flash)
  • Cloudflare AI Gateway — Claude Fable 5.1 (anthropic/claude-fable-5.1)
  • Ofox — Claude Fable 5.1 (anthropic/claude-fable-5.1)
  • Ofox — Qwen3.8 Max 0902 (bailian/qwen3.8-max-0902)
  • Baseten — GLM 5.3 Fast (zai-org/GLM-5.3-Fast)
  • EmpirioLabs AI — Muse Spark 1.3 (muse-spark-1-3)
  • SCNet Token Plan — GLM-5.3-Flash (GLM-5.3-Flash)
  • SCNet Token Plan — GLM-5.3 (GLM-5.3)
  • SCNet Token Plan — Qwen3.8 Flash (Qwen3.8-Flash)
  • AMD — DeepSeek V4 Flash Vision Exp (DeepSeek-V4-Flash-Vision-Exp)
  • AMD — MiniCPM5-1B (MiniCPM5-1B)
  • Vercel AI Gateway — GLM 5.3 Fast (zai/glm-5.3-fast)
  • Eden AI — Gemini 3.8 Flash (google/gemini-3.8-flash)
  • Eden AI — Gemini 3.8 Flash (US) (vertex/gemini-3.8-flash@us)
  • Eden AI — Gemini 3.8 Flash (vertex/gemini-3.8-flash)
  • Eden AI — Gemini 3.8 Flash (EU) (vertex/gemini-3.8-flash@eu)
  • Eden AI — Inkling (fireworks_ai/accounts/fireworks/models/inkling)
  • DevPass (LLM Gateway) — Muse Spark 1.3 Contributor (muse-spark-1.3-contributor)
  • DevPass (LLM Gateway) — Qwen3.8 27B (Qwen3.8-27B)
  • DevPass (LLM Gateway) — Muse Spark 1.3 (muse-spark-1.3)
  • GitHub Copilot — Claude Fable 5.1 (claude-fable-5.1)
  • GitHub Copilot — Gemini 3.8 Flash (gemini-3.8-flash)
  • Kilo Gateway — Nemotron 3.5 Content Safety (nvidia/nemotron-3.5-content-safety)
  • Kilo Gateway — Ling 3.0 Flash Fin (inclusionai/ling-3.0-flash-fin)

Removed models (14)

  • NanoGPT — GLM Z1 Air (glm-z1-air)
  • NanoGPT — Hermes 4 Medium (NousResearch/hermes-4-70b)
  • NanoGPT — Dots3-Note Preview (dots-studio/dots-3-note-preview)
  • Tinfoil — GLM-5.2 (glm-5-2)
  • Eden AI — GPT OSS 120B (fireworks_ai/accounts/fireworks/models/gpt-oss-120b)
  • DevPass (LLM Gateway) — Qwen3.8 27B (qwen3.8-27b)
  • GitHub Copilot — Gemini 3.1 Pro Preview (gemini-3.1-pro-preview)
  • GitHub Copilot — Claude Opus 4.5 (latest) (claude-opus-4.5)
  • GitHub Copilot — Claude Sonnet 4 (latest) (claude-sonnet-4)
  • GitHub Copilot — GPT-5.2 (gpt-5.2)
  • GitHub Copilot — Claude Opus 4.6 (claude-opus-4.6)
  • GitHub Copilot — GPT-5.2 Codex (gpt-5.2-codex)
  • GitHub Copilot — GPT-4.1 (gpt-4.1)
  • GitHub Copilot — Claude Sonnet 4.5 (latest) (claude-sonnet-4.5)

Price changes (27)

  • OpenRouter — Nemotron 3 Ultra 550B A55B: input $0.6 → $0.625, output $2.4 → $3.125
  • OpenRouter — ReMM SLERP 13B: input $0.45 → $0.35
  • OpenRouter — DeepSeek V3.1: input $0.25 → $0.55, output $0.95 → $1.65
  • OpenRouter — DeepSeek Chat: input $0.2574 → $0.32, output $1.029 → $0.89
  • OpenRouter — Qwen2.5 VL 72B Instruct: input $0.25 → $0.8, output $0.75 → $1
  • OpenRouter — Qwen3 14B: input $0.2275 → $0.12, output $0.91 → $0.24
  • OpenRouter — Qwen3.8 27B: input $0.425 → $0.42, output $2.55 → $3
  • OpenRouter — GLM Latest: input $1.106 → $1.15, output $3.476 → $3.5
  • OpenRouter — MoonshotAI Kimi Latest: input $2.55 → $2.5, output $12.75 → $14
  • CrossModel — Gemini 3.6 Flash: input $1.5 → $0.75, output $7.5 → $3.75
  • Charm Hyper — Gemma 4 26B A4B IT: input $0.116 → $0.106, output $0.38 → $0.368
  • Charm Hyper — GLM-5: input $0.85 → $0.93, output $2.774 → $2.878
  • Charm Hyper — MiniMax-M2.7: input $0.426 → $0.418, output $1.62 → $1.588
  • Vercel AI Gateway — GLM 5.3: input $1.4 → $0.7, output $4.4 → $2.2
  • Eden AI — DeepSeek V4 Pro 0813: input $0.5808 → $1.122, output $1.742 → $3.366
  • Eden AI — Qwen3.8 Flash: input $0.16 → $0.15
  • Eden AI — DeepSeek V4 Flash 0731: input $0.176 → $0.352, output $0.528 → $1.056
  • Eden AI — GPT OSS 120B: input $0.1737 → $0.1742, output $0.7526 → $0.755
  • Eden AI — Llama-3.3-70B-Instruct: input $0.7526 → $0.755, output $0.7526 → $0.755
  • Eden AI — Llama-3.3-70B-Instruct: input $1.042 → $1.045, output $1.042 → $1.045
  • Eden AI — GPT OSS 120B: input $0.1737 → $0.1742, output $0.6947 → $0.6969
  • Eden AI — DeepSeek V4 Flash 0731: input $0.4631 → $0.4646, output $0.9262 → $0.9292
  • Kilo Gateway — DeepSeek Chat: input $0.2574 → $0.32, output $1.029 → $0.89
  • Kilo Gateway — Qwen: Qwen2.5 VL 72B Instruct: input $0.25 → $0.8, output $0.75 → $1
  • Kilo Gateway — Z.ai: GLM Latest: input $1.106 → $1.15, output $3.476 → $3.5
  • Kilo Gateway — MoonshotAI Kimi Latest: input $2.55 → $2.5, output $12.75 → $14
  • Kilo Gateway — IBM: Granite 4.2 8B: input $0.1 → $0.06, output $0.15 → $0.25