chore(pricing): refresh models.dev snapshot - #537

Open
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing
Open

chore(pricing): refresh models.dev snapshot#537
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing

Conversation

@github-actions

@github-actionsgithub-actionsBot commented Aug 24, 2026

Copy link
Copy Markdown
Contributor

Refreshes the vendored models.dev pricing snapshot from the upstream API.

Providers: 191 → 195. Models: 6728 → 7293.

Validation

  • The refreshed payload parsed as JSON and passed provider/model count and critical-model integrity checks.
  • cargo test -p relayburn-sdk passed with the refreshed snapshot embedded.
  • This PR is created with GITHUB_TOKEN, so GitHub does not automatically trigger pull_request workflows for it; the full SDK suite ran in the update workflow instead.

Primary-provider models added (1)

  • google-vertex/claude-fable-5@default

Other models added (624)

  • agentrouter/claude-opus-4-8
  • agentrouter/claude-opus-5
  • agentrouter/gpt-5.6-sol
  • aki-io/deepseek-v4-flash-0731-284b
  • aki-io/qwen3.8-27b
  • amazon-bedrock/xai.grok-4.6
  • azure-cognitive-services/claude-opus-4-7
  • azure/claude-opus-4-7
  • crof/qwen3.8-27b
  • crossmodel/deepseek/deepseek-v4-flash-vision-exp
  • crossmodel/z-ai/glm-5.3
  • deepseek/deepseek-v4-flash-vision-exp
  • echo/echo
  • edenai/deepseek/deepseek-v4-flash-vision-exp
  • edenai/nebius/deepseek-ai/DeepSeek-V4-Flash-0731
  • edenai/qwen/qwen3.8-27b
  • edenai/zai/glm-5.3
  • empiriolabs/glm-4-6v-flash
  • empiriolabs/glm-5-3
  • google-vertex-anthropic/claude-fable-5@default
  • hetzner/Qwen3.8-27B
  • huggingface/zai-org/GLM-4.6V-Flash
  • kilo/deepseek/deepseek-v4-flash-vision-exp
  • kilo/liquid/lfm-2.5-2.6b:free
  • kilo/meituan/longcat-2.0-free
  • kilo/meta/muse-spark-1.2-contributor
  • kilo/mistralai/ministral-8b
  • kilo/openai/gpt-5.6-sol-discounted
  • kilo/stealth/ox-alpha
  • kilo/tencent/hy-mt2-1.8b
  • kilo/tencent/hy-mt2-30b-a3b
  • kilo/tencent/hy-mt2-7b
  • kilo/thinkingmachines/inkling-small:free
  • kilo/thinkingmachines/inkling:free
  • kilo/z-ai/glm-5.3
  • kilo/~z-ai/glm-latest
  • llmgateway-providers/alibaba/deepseek-v4-flash
  • llmgateway-providers/alibaba/deepseek-v4-pro
  • llmgateway-providers/alibaba/glm-5
  • llmgateway-providers/alibaba/glm-5.2
  • llmgateway-providers/alibaba/kimi-k2.5
  • llmgateway-providers/alibaba/qwen-coder-plus
  • llmgateway-providers/alibaba/qwen-flash
  • llmgateway-providers/alibaba/qwen-max
  • llmgateway-providers/alibaba/qwen-omni-turbo
  • llmgateway-providers/alibaba/qwen-plus
  • llmgateway-providers/alibaba/qwen-plus-latest
  • llmgateway-providers/alibaba/qwen3-coder-flash
  • llmgateway-providers/alibaba/qwen3-coder-plus
  • llmgateway-providers/alibaba/qwen3-max
  • llmgateway-providers/alibaba/qwen3-vl-flash
  • llmgateway-providers/alibaba/qwen3-vl-plus
  • llmgateway-providers/alibaba/qwen3.6-35b-a3b
  • llmgateway-providers/alibaba/qwen3.6-flash
  • llmgateway-providers/alibaba/qwen3.6-max-preview
  • llmgateway-providers/alibaba/qwen3.6-plus
  • llmgateway-providers/alibaba/qwen3.7-flash
  • llmgateway-providers/alibaba/qwen3.7-max
  • llmgateway-providers/alibaba/qwen3.7-plus
  • llmgateway-providers/alibaba/qwen3.8-max
  • llmgateway-providers/alibaba/qwen35-397b-a17b
  • llmgateway-providers/anthropic/claude-fable-5
  • llmgateway-providers/anthropic/claude-haiku-4-5
  • llmgateway-providers/anthropic/claude-haiku-4-5-20251001
  • llmgateway-providers/anthropic/claude-opus-4-5-20251101
  • llmgateway-providers/anthropic/claude-opus-4-6
  • llmgateway-providers/anthropic/claude-opus-4-7
  • llmgateway-providers/anthropic/claude-opus-4-8
  • llmgateway-providers/anthropic/claude-opus-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5-20250929
  • llmgateway-providers/anthropic/claude-sonnet-4-6
  • llmgateway-providers/anthropic/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/claude-fable-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5-20251001
  • llmgateway-providers/aws-bedrock/claude-opus-4-1-20250805
  • llmgateway-providers/aws-bedrock/claude-opus-4-5-20251101
  • llmgateway-providers/aws-bedrock/claude-opus-4-6
  • llmgateway-providers/aws-bedrock/claude-opus-4-7
  • llmgateway-providers/aws-bedrock/claude-opus-4-8
  • llmgateway-providers/aws-bedrock/claude-opus-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5-20250929
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-6
  • llmgateway-providers/aws-bedrock/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/grok-4-3
  • llmgateway-providers/aws-bedrock/grok-4-6
  • llmgateway-providers/aws-bedrock/llama-3.1-70b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-maverick-17b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-scout-17b-instruct
  • llmgateway-providers/aws-mantle/gpt-5.6-luna
  • llmgateway-providers/aws-mantle/gpt-5.6-sol
  • llmgateway-providers/aws-mantle/gpt-5.6-terra
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-non-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-3
  • llmgateway-providers/azure/gpt-3.5-turbo
  • llmgateway-providers/azure/gpt-4
  • llmgateway-providers/azure/gpt-4-turbo
  • …and 524 more

Primary-provider models removed (0)

None.

Other models removed (60)

  • aki-io/minimax-m2.5-230b
  • crof/glm-4.7
  • crof/glm-4.7-flash
  • crof/glm-5
  • crof/kimi-k2.5
  • crof/kimi-k2.5-lightning
  • crof/minimax-m2.5
  • edenai/deepinfra/tencent/Hy3
  • edenai/tensorx/qwen/qwen3.8-27b
  • hetzner/DeepSeek-V4-Flash-0731
  • hetzner/GLM-5.2-NVFP4
  • hetzner/Kimi-K2.7-Code
  • inceptron/MiniMaxAI/MiniMax-M2.5
  • kilo/ai21/jamba-large-1.7
  • kilo/deepcogito/cogito-v2.1-671b
  • kilo/deepseek/deepseek-v4-flash:discounted
  • kilo/deepseek/deepseek-v4-pro:discounted
  • kilo/stealth/gpt-5.6-sol
  • kilo/z-ai/glm-5.2:free
  • llmgateway/claude-3-opus
  • llmgateway/gpt-4o-mini-search-preview
  • llmgateway/gpt-4o-search-preview
  • llmgateway/seed-2-1-turbo
  • nano-gpt/TEE/deepseek-v4-pro-0813
  • nano-gpt/TEE/deepseek-v4-pro-0813:thinking
  • nano-gpt/amazon/nova-micro-v1
  • openrouter/ai21/jamba-large-1.7
  • openrouter/deepcogito/cogito-v2.1-671b
  • openrouter/openai/gpt-oss-20b:free
  • scx/MiniMax-M2.7
  • scx/gpt-oss-120b
  • umans-ai-coding-plan/umans-glm-5.1
  • umans-ai/umans-glm-5.1
  • venice/nvidia-nemotron-3-5-lightning-30b-a3b
  • vercel/google/imagen-4.0-fast-generate-001
  • vercel/google/imagen-4.0-generate-001
  • vercel/google/imagen-4.0-ultra-generate-001
  • vercel/xai/grok-4.1-fast-non-reasoning
  • vercel/xai/grok-4.1-fast-reasoning
  • vercel/xai/grok-4.20-multi-agent
  • vercel/xai/grok-4.20-multi-agent-beta
  • vercel/xai/grok-4.20-non-reasoning
  • vercel/xai/grok-4.20-non-reasoning-beta
  • vercel/xai/grok-4.20-reasoning
  • vercel/xai/grok-4.20-reasoning-beta
  • vercel/xai/grok-4.3
  • vercel/xai/grok-4.5
  • vercel/xai/grok-4.6
  • vercel/xai/grok-build-0.1
  • vercel/xai/grok-imagine-image
  • vercel/xai/grok-imagine-image-2.0
  • vercel/xai/grok-imagine-video
  • vercel/xai/grok-imagine-video-1.5
  • vercel/xai/grok-imagine-video-1.5-preview
  • vercel/xai/grok-stt
  • vercel/xai/grok-tts
  • vercel/xai/grok-voice-think-fast-1.0
  • vercel/xai/grok-voice-think-fast-2.0
  • vercel/zai/glm-4.6v
  • vercel/zai/glm-4.6v-flash

Primary-provider price fields changed (11)

  • google-vertex/deepseek-ai/deepseek-v3.1-maas — cache_read: missing0.06
  • google-vertex/gemini-2.5-flash — cache_read: 0.0750.03; cache_write: 0.383missing; input_audio: missing1
  • google-vertex/gemini-3-pro-image — cache_read: missing0.2
  • google-vertex/gemini-3.1-flash-image — cache_read: missing0.05
  • google-vertex/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google-vertex/moonshotai/kimi-k2-thinking-maas — cache_read: missing0.06
  • google-vertex/openai/gpt-oss-20b-maas — cache_read: missing0.007
  • google-vertex/zai-org/glm-4.7-maas — cache_read: missing0.06
  • google/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google/gemini-flash-latest — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 93.75
  • google/gemini-flash-lite-latest — cache_read: 0.0250.03; input: 0.250.3; input_audio: 0.5missing; output: 1.52.5

Other price fields changed (172)

  • aki-io/kimi-k2.7-code-1100b — cache_read: missing0.18
  • alibaba-cn/qwen-plus — cache_read: missing0.012; cache_write: missing0.144
  • ambient/ambient/large — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • ambient/deepseek/deepseek-v4-flash-0731 — cache_read: 0.0280.016; input: 0.140.08; output: 0.280.18
  • ambient/z-ai/glm-5.2 — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • chutes/Qwen/Qwen3.8-27B-TEE — cache_read: 0.0399999999999999940.03499999999999999; input: 0.40.35; output: 32.75
  • cortecs/gpt-5.6-luna — cache_read: 0.110.022; cache_write: 1.380.275; input: 1.10.219; output: 6.5991.32
  • cortecs/gpt-5.6-terra — cache_read: 0.2750.219; cache_write: 3.4372.749; input: 2.7492.2; output: 16.49813.199
  • cortecs/minimax-m2.5 — cache_read: 0.030.075; output: 1.0871.186
  • digitalocean/glm-5 — input: 0.751; output: 2.43.2
  • digitalocean/glm-5.1 — input: 0.9751.3
  • digitalocean/kimi-k2.5 — input: 0.3750.5; output: 2.0252.7
  • digitalocean/kimi-k2.6 — input: 0.760.95; output: 3.24
  • digitalocean/minimax-m2.5 — input: 0.2250.3; output: 0.91.2
  • digitalocean/nvidia-nemotron-3-super-120b — input: 0.1650.3; output: 0.35750.65
  • digitalocean/qwen3.5-397b-a17b — input: 0.30250.55; output: 1.9253.5
  • edenai/deepseek/deepseek-v4-flash — cache_read: 0.0070.014; input: 0.220.44; output: 0.661.32
  • edenai/deepseek/deepseek-v4-pro — cache_read: 0.0220.044; input: 0.661.32; output: 1.983.96
  • edenai/fireworks_ai/accounts/fireworks/models/deepseek-v4-flash-0731 — cache_read: 0.0280.007; input: 0.140.22; output: 0.280.66
  • edenai/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/google/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/ionos/meta-llama/Llama-3.3-70B-Instruct — input: 0.7535450.760435; output: 0.7535450.760435
  • edenai/ionos/openai/gpt-oss-120b — input: 0.1738950.175485; output: 0.7535450.760435
  • edenai/mistral/codestral-latest — input: 10.3; output: 30.9
  • edenai/mistral/mistral-small-latest — input: 0.060.15; output: 0.180.6
  • edenai/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/openai/gpt-latest — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/qwen/deepseek-v4-flash-0731 — cache_read: 0.04missing; input: 0.20.352; output: 0.41.056
  • edenai/qwen/deepseek-v4-pro-0813 — input: 1.321.1616; output: 3.963.4848
  • edenai/scaleway/deepseek-v4-flash-0731 — input: 0.463720.46796; output: 0.9274410.93592
  • edenai/scaleway/gpt-oss-120b — input: 0.1738950.175485; output: 0.695580.70194
  • edenai/scaleway/llama-3.3-70b-instruct — input: 1.0433711.05291; output: 1.0433711.05291
  • edenai/vertex/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@eu — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@us — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • empiriolabs/deepseek-v4-flash-0731 — cache_read: 0.140.424; input: 0.140.424; output: 0.281.272
  • github-copilot/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25}; input: 52.5; output: 3015; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25,"tier":{"type":"context","size":272000}}]
  • hyper/deepseek-v4-flash-0731 — cache_read: 0.0280.015243; input: 0.130.479072; output: 0.261.437216
  • hyper/deepseek-v4-pro-0813 — cache_read: 0.1320.047907; input: 1.321.437216; output: 3.964.311648
  • hyper/gemma-4-26b-a4b-it — cache_write: 0.0620.055; input: 0.1240.11; output: 0.420.408
  • hyper/glm-5 — cache_write: 0.40.455; input: 0.80.91; output: 2.5822.934
  • hyper/glm-5.1 — cache_read: 0.283088missing; cache_write: missing0.68; input: 1.524321.36; output: 4.790724.4
  • hyper/glm-5.2 — cache_read: 0.280.152432; input: 1.41.52432; output: 4.44.79072
  • hyper/gpt-oss-120b — cache_read: 0.015243missing; cache_write: missing0.094; input: 0.163320.188; output: 0.653280.7
  • hyper/kimi-k2.5 — cache_write: 0.2550.2722; input: 0.510.5444; output: 2.72.855
  • hyper/kimi-k2.6 — cache_read: 0.160.174208; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k2.7-code — cache_read: 0.190.206872; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k3 — cache_read: 0.30.32664; input: 33.2664; output: 1516.332
  • hyper/llama-3.3-70b-instruct — cache_write: 0.2990.319; input: 0.5980.638; output: 0.7380.768
  • hyper/minimax-m2.7 — cache_write: 0.2050.204; input: 0.410.408; output: 1.521.512
  • kilo/deepseek/deepseek-v4-flash-0731 — input: 0.140.44; output: 0.281.32
  • kilo/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • kilo/google/gemma-4-26b-a4b-it — input: 0.070.042; output: 0.340.22
  • kilo/meta/muse-glimmer-30b — output: 1.21.1
  • kilo/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • kilo/nvidia/nemotron-3-nano-30b-a3b — cache_read: 0.030.025
  • kilo/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/openai/gpt-5.6-sol-pro — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/qwen/qwen3.8-27b — cache_read: 0.050.085; cache_write: missing0.53125; input: 0.450.425; output: 3.22.55
  • kilo/~deepseek/deepseek-v4-flash-latest — cache_read: 0.0157190.008; input: 0.0785960.04; output: 0.1571920.08
  • kilo/~openai/gpt-latest — cache_read: 0.250.2; cache_write: 3.1252.5; input: 2.52; output: 1510
  • llmgateway/gpt-oss-20b — input: 0.040.05; output: 0.150.2
  • llmgateway/nemotron-3-ultra-550b — cache_read: 0.150.1; output: 2.52.2
  • llmgateway/qwen3-coder-480b-a35b-instruct — input: 0.30.38; output: 1.31.55
  • llmgateway/qwen3.7-max — cache_read: 0.1250.25
  • merge-gateway/deepseek/deepseek-v4-flash — cache_read: 0.00280.007; input: 0.140.22; output: 0.280.66
  • merge-gateway/deepseek/deepseek-v4-flash-0731 — cache_read: 0.00280.007; input: 0.140.035; output: 0.280.07
  • merge-gateway/deepseek/deepseek-v4-pro — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/openai/gpt-5.6-sol — input: 54; output: 3024
  • nano-gpt/google/gemini-flash-latest — cache_read: 0.0750.0375; cache_write: 0.0416670.020833; input: 0.750.375; output: 3.751.875
  • nano-gpt/google/gemma-4-26b-a4b-it — cache_read: 0.0650.04; input: 0.130.08; output: 0.40.33
  • nano-gpt/google/gemma-4-31b-it — cache_read: 0.050.04; input: 0.10.08; output: 0.350.33
  • nano-gpt/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-5.6-sol-pro — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-chat-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/venice-uncensored — cache_read: 0.20.4; output: 0.41.8
  • ofox/bailian/qwen3.6-max-preview — cache_write: 21.17; input: 22.15; output: 1212.86
  • ofox/google/gemini-3.6-flash — cache_read: 0.150.075; cache_write: 0.0830.0415; input: 1.50.75; output: 7.53.75
  • ofox/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • ofox/volcengine/doubao-seed-2.1-pro — cache_read: 0.1770.1416; cache_write: 0.00250.002; input: 0.8840.7072; output: 4.423.536
  • ofox/volcengine/doubao-seed-2.1-turbo — cache_read: 0.0850.068; cache_write: 0.00240.0019; input: 0.4420.3536; output: 2.2121.7696
  • ofox/z-ai/glm-5.2 — cache_read: 0.260.182; input: 1.40.98; output: 4.43.08
  • opencode-go/gpt-5.6-luna — cache_read: 0.010.02; cache_write: 0.1250.25; context_over_200k: {"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25}{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5}; input: 0.10.2; output: 0.61.2; tiers: [{"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25,"tier":{"type":"context","size":272000}}][{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5,"tier":{"type":"context","size":272000}}]
  • opencode-go/hy3 — cache_read: 0.0350.004375; input: 0.140.0175; output: 0.580.0725
  • opencode/gpt-5.6-sol — cache_read: 0.50.2; cache_write: 6.252.5; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":4,"output":15,"cache_read":0.4,"cache_write":5}; input: 52; output: 3010; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":4,"output":15,"cache_read":0.4,"cache_write":5,"tier":{"type":"context","size":272000}}]
  • openrouter/deepseek/deepseek-chat-v3-0324 — cache_read: 0.135missing; input: 0.270.25; output: 1.121
  • openrouter/deepseek/deepseek-chat-v3.1 — cache_read: 0.130.55; input: 0.250.55; output: 0.951.65
  • openrouter/deepseek/deepseek-v3.1-terminus — cache_read: missing0.135
  • openrouter/deepseek/deepseek-v3.2 — cache_read: 0.13450.13; input: 0.2690.26; output: 0.40.38
  • openrouter/deepseek/deepseek-v4-flash — cache_read: 0.016520.01148; input: 0.08260.0574; output: 0.16520.1148
  • openrouter/deepseek/deepseek-v4-pro — cache_read: 0.0220.043848; input: 0.660.526176; output: 1.981.052352
  • openrouter/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0220.0374; input: 0.661.122; output: 1.983.366
  • openrouter/minimax/minimax-m2.5 — cache_read: 0.050.027; input: 0.220.27; output: 0.91.08
  • openrouter/minimax/minimax-m2.7 — cache_read: 0.060.048; input: 0.30.24; output: 1.20.96
  • openrouter/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • openrouter/moonshotai/kimi-k2.5 — cache_read: 0.0950.07; input: 0.570.45; output: 2.852.25
  • openrouter/moonshotai/kimi-k2.7-code — cache_read: 0.150.17; input: 0.710.67; output: 3.53.4
  • …and 72 more

An extended generated list is available in the workflow run summary.

Generated automatically by the weekly pricing refresh workflow.

Review in cubic

@devin-ai-integrationdevin-ai-integrationBot left a comment

Copy link
Copy Markdown
Contributor

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

✅ Devin Review: No Issues Found

Devin Review analyzed this PR and found no bugs or issues to report.

Open in Devin Review

Sign up for freeto join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant

@willwashburn
, 'i'); if (__m === '*' || __re.test(location.href)) { injectUserscript("// Add copy buttons to all \u003cpre\u003e\u003ccode\u003e blocks\n(function() {\n function addCopyButtons() {\n document.querySelectorAll('pre code').forEach(function(codeBlock) {\n if (codeBlock.parentElement.hasAttribute('data-copy-added')) return;\n codeBlock.parentElement.setAttribute('data-copy-added', 'true');\n \n var btn = document.createElement('button');\n btn.textContent = 'Copy';\n btn.style.cssText = 'position:absolute;top:4px;right:4px;padding:2px 8px;font-size:11px;background:#4ecdc4;border:none;border-radius:4px;color:#1a1a2e;cursor:pointer;opacity:0.7;transition:opacity 0.2s;';\n btn.onmouseover = function() { this.style.opacity = '1'; };\n btn.onmouseout = function() { this.style.opacity = '0.7'; };\n btn.onclick = function() {\n navigator.clipboard.writeText(codeBlock.textContent).then(function() {\n btn.textContent = 'Copied!';\n setTimeout(function() { btn.textContent = 'Copy'; }, 1500);\n });\n };\n codeBlock.parentElement.style.position = 'relative';\n codeBlock.parentElement.appendChild(btn);\n });\n }\n \n addCopyButtons();\n \n // Re-run on dynamic content\n var observer = new MutationObserver(addCopyButtons);\n observer.observe(document.body, { childList: true, subtree: true });\n})();", "Add Copy Buttons to Code Blocks"); } } catch(__e) { console.warn('[Userscript:Add Copy Buttons to Code Blocks]', __e); } })(); (function(){ try { var __m = "github.com"; var __re = new RegExp('^' + "github\\.com" + '
Skip to content

chore(pricing): refresh models.dev snapshot - #537

Open
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing
Open

chore(pricing): refresh models.dev snapshot#537
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing

Conversation

@github-actions

@github-actionsgithub-actionsBot commented Aug 24, 2026

Copy link
Copy Markdown
Contributor

Refreshes the vendored models.dev pricing snapshot from the upstream API.

Providers: 191 → 195. Models: 6728 → 7293.

Validation

  • The refreshed payload parsed as JSON and passed provider/model count and critical-model integrity checks.
  • cargo test -p relayburn-sdk passed with the refreshed snapshot embedded.
  • This PR is created with GITHUB_TOKEN, so GitHub does not automatically trigger pull_request workflows for it; the full SDK suite ran in the update workflow instead.

Primary-provider models added (1)

  • google-vertex/claude-fable-5@default

Other models added (624)

  • agentrouter/claude-opus-4-8
  • agentrouter/claude-opus-5
  • agentrouter/gpt-5.6-sol
  • aki-io/deepseek-v4-flash-0731-284b
  • aki-io/qwen3.8-27b
  • amazon-bedrock/xai.grok-4.6
  • azure-cognitive-services/claude-opus-4-7
  • azure/claude-opus-4-7
  • crof/qwen3.8-27b
  • crossmodel/deepseek/deepseek-v4-flash-vision-exp
  • crossmodel/z-ai/glm-5.3
  • deepseek/deepseek-v4-flash-vision-exp
  • echo/echo
  • edenai/deepseek/deepseek-v4-flash-vision-exp
  • edenai/nebius/deepseek-ai/DeepSeek-V4-Flash-0731
  • edenai/qwen/qwen3.8-27b
  • edenai/zai/glm-5.3
  • empiriolabs/glm-4-6v-flash
  • empiriolabs/glm-5-3
  • google-vertex-anthropic/claude-fable-5@default
  • hetzner/Qwen3.8-27B
  • huggingface/zai-org/GLM-4.6V-Flash
  • kilo/deepseek/deepseek-v4-flash-vision-exp
  • kilo/liquid/lfm-2.5-2.6b:free
  • kilo/meituan/longcat-2.0-free
  • kilo/meta/muse-spark-1.2-contributor
  • kilo/mistralai/ministral-8b
  • kilo/openai/gpt-5.6-sol-discounted
  • kilo/stealth/ox-alpha
  • kilo/tencent/hy-mt2-1.8b
  • kilo/tencent/hy-mt2-30b-a3b
  • kilo/tencent/hy-mt2-7b
  • kilo/thinkingmachines/inkling-small:free
  • kilo/thinkingmachines/inkling:free
  • kilo/z-ai/glm-5.3
  • kilo/~z-ai/glm-latest
  • llmgateway-providers/alibaba/deepseek-v4-flash
  • llmgateway-providers/alibaba/deepseek-v4-pro
  • llmgateway-providers/alibaba/glm-5
  • llmgateway-providers/alibaba/glm-5.2
  • llmgateway-providers/alibaba/kimi-k2.5
  • llmgateway-providers/alibaba/qwen-coder-plus
  • llmgateway-providers/alibaba/qwen-flash
  • llmgateway-providers/alibaba/qwen-max
  • llmgateway-providers/alibaba/qwen-omni-turbo
  • llmgateway-providers/alibaba/qwen-plus
  • llmgateway-providers/alibaba/qwen-plus-latest
  • llmgateway-providers/alibaba/qwen3-coder-flash
  • llmgateway-providers/alibaba/qwen3-coder-plus
  • llmgateway-providers/alibaba/qwen3-max
  • llmgateway-providers/alibaba/qwen3-vl-flash
  • llmgateway-providers/alibaba/qwen3-vl-plus
  • llmgateway-providers/alibaba/qwen3.6-35b-a3b
  • llmgateway-providers/alibaba/qwen3.6-flash
  • llmgateway-providers/alibaba/qwen3.6-max-preview
  • llmgateway-providers/alibaba/qwen3.6-plus
  • llmgateway-providers/alibaba/qwen3.7-flash
  • llmgateway-providers/alibaba/qwen3.7-max
  • llmgateway-providers/alibaba/qwen3.7-plus
  • llmgateway-providers/alibaba/qwen3.8-max
  • llmgateway-providers/alibaba/qwen35-397b-a17b
  • llmgateway-providers/anthropic/claude-fable-5
  • llmgateway-providers/anthropic/claude-haiku-4-5
  • llmgateway-providers/anthropic/claude-haiku-4-5-20251001
  • llmgateway-providers/anthropic/claude-opus-4-5-20251101
  • llmgateway-providers/anthropic/claude-opus-4-6
  • llmgateway-providers/anthropic/claude-opus-4-7
  • llmgateway-providers/anthropic/claude-opus-4-8
  • llmgateway-providers/anthropic/claude-opus-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5-20250929
  • llmgateway-providers/anthropic/claude-sonnet-4-6
  • llmgateway-providers/anthropic/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/claude-fable-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5-20251001
  • llmgateway-providers/aws-bedrock/claude-opus-4-1-20250805
  • llmgateway-providers/aws-bedrock/claude-opus-4-5-20251101
  • llmgateway-providers/aws-bedrock/claude-opus-4-6
  • llmgateway-providers/aws-bedrock/claude-opus-4-7
  • llmgateway-providers/aws-bedrock/claude-opus-4-8
  • llmgateway-providers/aws-bedrock/claude-opus-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5-20250929
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-6
  • llmgateway-providers/aws-bedrock/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/grok-4-3
  • llmgateway-providers/aws-bedrock/grok-4-6
  • llmgateway-providers/aws-bedrock/llama-3.1-70b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-maverick-17b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-scout-17b-instruct
  • llmgateway-providers/aws-mantle/gpt-5.6-luna
  • llmgateway-providers/aws-mantle/gpt-5.6-sol
  • llmgateway-providers/aws-mantle/gpt-5.6-terra
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-non-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-3
  • llmgateway-providers/azure/gpt-3.5-turbo
  • llmgateway-providers/azure/gpt-4
  • llmgateway-providers/azure/gpt-4-turbo
  • …and 524 more

Primary-provider models removed (0)

None.

Other models removed (60)

  • aki-io/minimax-m2.5-230b
  • crof/glm-4.7
  • crof/glm-4.7-flash
  • crof/glm-5
  • crof/kimi-k2.5
  • crof/kimi-k2.5-lightning
  • crof/minimax-m2.5
  • edenai/deepinfra/tencent/Hy3
  • edenai/tensorx/qwen/qwen3.8-27b
  • hetzner/DeepSeek-V4-Flash-0731
  • hetzner/GLM-5.2-NVFP4
  • hetzner/Kimi-K2.7-Code
  • inceptron/MiniMaxAI/MiniMax-M2.5
  • kilo/ai21/jamba-large-1.7
  • kilo/deepcogito/cogito-v2.1-671b
  • kilo/deepseek/deepseek-v4-flash:discounted
  • kilo/deepseek/deepseek-v4-pro:discounted
  • kilo/stealth/gpt-5.6-sol
  • kilo/z-ai/glm-5.2:free
  • llmgateway/claude-3-opus
  • llmgateway/gpt-4o-mini-search-preview
  • llmgateway/gpt-4o-search-preview
  • llmgateway/seed-2-1-turbo
  • nano-gpt/TEE/deepseek-v4-pro-0813
  • nano-gpt/TEE/deepseek-v4-pro-0813:thinking
  • nano-gpt/amazon/nova-micro-v1
  • openrouter/ai21/jamba-large-1.7
  • openrouter/deepcogito/cogito-v2.1-671b
  • openrouter/openai/gpt-oss-20b:free
  • scx/MiniMax-M2.7
  • scx/gpt-oss-120b
  • umans-ai-coding-plan/umans-glm-5.1
  • umans-ai/umans-glm-5.1
  • venice/nvidia-nemotron-3-5-lightning-30b-a3b
  • vercel/google/imagen-4.0-fast-generate-001
  • vercel/google/imagen-4.0-generate-001
  • vercel/google/imagen-4.0-ultra-generate-001
  • vercel/xai/grok-4.1-fast-non-reasoning
  • vercel/xai/grok-4.1-fast-reasoning
  • vercel/xai/grok-4.20-multi-agent
  • vercel/xai/grok-4.20-multi-agent-beta
  • vercel/xai/grok-4.20-non-reasoning
  • vercel/xai/grok-4.20-non-reasoning-beta
  • vercel/xai/grok-4.20-reasoning
  • vercel/xai/grok-4.20-reasoning-beta
  • vercel/xai/grok-4.3
  • vercel/xai/grok-4.5
  • vercel/xai/grok-4.6
  • vercel/xai/grok-build-0.1
  • vercel/xai/grok-imagine-image
  • vercel/xai/grok-imagine-image-2.0
  • vercel/xai/grok-imagine-video
  • vercel/xai/grok-imagine-video-1.5
  • vercel/xai/grok-imagine-video-1.5-preview
  • vercel/xai/grok-stt
  • vercel/xai/grok-tts
  • vercel/xai/grok-voice-think-fast-1.0
  • vercel/xai/grok-voice-think-fast-2.0
  • vercel/zai/glm-4.6v
  • vercel/zai/glm-4.6v-flash

Primary-provider price fields changed (11)

  • google-vertex/deepseek-ai/deepseek-v3.1-maas — cache_read: missing0.06
  • google-vertex/gemini-2.5-flash — cache_read: 0.0750.03; cache_write: 0.383missing; input_audio: missing1
  • google-vertex/gemini-3-pro-image — cache_read: missing0.2
  • google-vertex/gemini-3.1-flash-image — cache_read: missing0.05
  • google-vertex/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google-vertex/moonshotai/kimi-k2-thinking-maas — cache_read: missing0.06
  • google-vertex/openai/gpt-oss-20b-maas — cache_read: missing0.007
  • google-vertex/zai-org/glm-4.7-maas — cache_read: missing0.06
  • google/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google/gemini-flash-latest — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 93.75
  • google/gemini-flash-lite-latest — cache_read: 0.0250.03; input: 0.250.3; input_audio: 0.5missing; output: 1.52.5

Other price fields changed (172)

  • aki-io/kimi-k2.7-code-1100b — cache_read: missing0.18
  • alibaba-cn/qwen-plus — cache_read: missing0.012; cache_write: missing0.144
  • ambient/ambient/large — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • ambient/deepseek/deepseek-v4-flash-0731 — cache_read: 0.0280.016; input: 0.140.08; output: 0.280.18
  • ambient/z-ai/glm-5.2 — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • chutes/Qwen/Qwen3.8-27B-TEE — cache_read: 0.0399999999999999940.03499999999999999; input: 0.40.35; output: 32.75
  • cortecs/gpt-5.6-luna — cache_read: 0.110.022; cache_write: 1.380.275; input: 1.10.219; output: 6.5991.32
  • cortecs/gpt-5.6-terra — cache_read: 0.2750.219; cache_write: 3.4372.749; input: 2.7492.2; output: 16.49813.199
  • cortecs/minimax-m2.5 — cache_read: 0.030.075; output: 1.0871.186
  • digitalocean/glm-5 — input: 0.751; output: 2.43.2
  • digitalocean/glm-5.1 — input: 0.9751.3
  • digitalocean/kimi-k2.5 — input: 0.3750.5; output: 2.0252.7
  • digitalocean/kimi-k2.6 — input: 0.760.95; output: 3.24
  • digitalocean/minimax-m2.5 — input: 0.2250.3; output: 0.91.2
  • digitalocean/nvidia-nemotron-3-super-120b — input: 0.1650.3; output: 0.35750.65
  • digitalocean/qwen3.5-397b-a17b — input: 0.30250.55; output: 1.9253.5
  • edenai/deepseek/deepseek-v4-flash — cache_read: 0.0070.014; input: 0.220.44; output: 0.661.32
  • edenai/deepseek/deepseek-v4-pro — cache_read: 0.0220.044; input: 0.661.32; output: 1.983.96
  • edenai/fireworks_ai/accounts/fireworks/models/deepseek-v4-flash-0731 — cache_read: 0.0280.007; input: 0.140.22; output: 0.280.66
  • edenai/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/google/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/ionos/meta-llama/Llama-3.3-70B-Instruct — input: 0.7535450.760435; output: 0.7535450.760435
  • edenai/ionos/openai/gpt-oss-120b — input: 0.1738950.175485; output: 0.7535450.760435
  • edenai/mistral/codestral-latest — input: 10.3; output: 30.9
  • edenai/mistral/mistral-small-latest — input: 0.060.15; output: 0.180.6
  • edenai/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/openai/gpt-latest — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/qwen/deepseek-v4-flash-0731 — cache_read: 0.04missing; input: 0.20.352; output: 0.41.056
  • edenai/qwen/deepseek-v4-pro-0813 — input: 1.321.1616; output: 3.963.4848
  • edenai/scaleway/deepseek-v4-flash-0731 — input: 0.463720.46796; output: 0.9274410.93592
  • edenai/scaleway/gpt-oss-120b — input: 0.1738950.175485; output: 0.695580.70194
  • edenai/scaleway/llama-3.3-70b-instruct — input: 1.0433711.05291; output: 1.0433711.05291
  • edenai/vertex/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@eu — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@us — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • empiriolabs/deepseek-v4-flash-0731 — cache_read: 0.140.424; input: 0.140.424; output: 0.281.272
  • github-copilot/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25}; input: 52.5; output: 3015; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25,"tier":{"type":"context","size":272000}}]
  • hyper/deepseek-v4-flash-0731 — cache_read: 0.0280.015243; input: 0.130.479072; output: 0.261.437216
  • hyper/deepseek-v4-pro-0813 — cache_read: 0.1320.047907; input: 1.321.437216; output: 3.964.311648
  • hyper/gemma-4-26b-a4b-it — cache_write: 0.0620.055; input: 0.1240.11; output: 0.420.408
  • hyper/glm-5 — cache_write: 0.40.455; input: 0.80.91; output: 2.5822.934
  • hyper/glm-5.1 — cache_read: 0.283088missing; cache_write: missing0.68; input: 1.524321.36; output: 4.790724.4
  • hyper/glm-5.2 — cache_read: 0.280.152432; input: 1.41.52432; output: 4.44.79072
  • hyper/gpt-oss-120b — cache_read: 0.015243missing; cache_write: missing0.094; input: 0.163320.188; output: 0.653280.7
  • hyper/kimi-k2.5 — cache_write: 0.2550.2722; input: 0.510.5444; output: 2.72.855
  • hyper/kimi-k2.6 — cache_read: 0.160.174208; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k2.7-code — cache_read: 0.190.206872; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k3 — cache_read: 0.30.32664; input: 33.2664; output: 1516.332
  • hyper/llama-3.3-70b-instruct — cache_write: 0.2990.319; input: 0.5980.638; output: 0.7380.768
  • hyper/minimax-m2.7 — cache_write: 0.2050.204; input: 0.410.408; output: 1.521.512
  • kilo/deepseek/deepseek-v4-flash-0731 — input: 0.140.44; output: 0.281.32
  • kilo/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • kilo/google/gemma-4-26b-a4b-it — input: 0.070.042; output: 0.340.22
  • kilo/meta/muse-glimmer-30b — output: 1.21.1
  • kilo/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • kilo/nvidia/nemotron-3-nano-30b-a3b — cache_read: 0.030.025
  • kilo/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/openai/gpt-5.6-sol-pro — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/qwen/qwen3.8-27b — cache_read: 0.050.085; cache_write: missing0.53125; input: 0.450.425; output: 3.22.55
  • kilo/~deepseek/deepseek-v4-flash-latest — cache_read: 0.0157190.008; input: 0.0785960.04; output: 0.1571920.08
  • kilo/~openai/gpt-latest — cache_read: 0.250.2; cache_write: 3.1252.5; input: 2.52; output: 1510
  • llmgateway/gpt-oss-20b — input: 0.040.05; output: 0.150.2
  • llmgateway/nemotron-3-ultra-550b — cache_read: 0.150.1; output: 2.52.2
  • llmgateway/qwen3-coder-480b-a35b-instruct — input: 0.30.38; output: 1.31.55
  • llmgateway/qwen3.7-max — cache_read: 0.1250.25
  • merge-gateway/deepseek/deepseek-v4-flash — cache_read: 0.00280.007; input: 0.140.22; output: 0.280.66
  • merge-gateway/deepseek/deepseek-v4-flash-0731 — cache_read: 0.00280.007; input: 0.140.035; output: 0.280.07
  • merge-gateway/deepseek/deepseek-v4-pro — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/openai/gpt-5.6-sol — input: 54; output: 3024
  • nano-gpt/google/gemini-flash-latest — cache_read: 0.0750.0375; cache_write: 0.0416670.020833; input: 0.750.375; output: 3.751.875
  • nano-gpt/google/gemma-4-26b-a4b-it — cache_read: 0.0650.04; input: 0.130.08; output: 0.40.33
  • nano-gpt/google/gemma-4-31b-it — cache_read: 0.050.04; input: 0.10.08; output: 0.350.33
  • nano-gpt/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-5.6-sol-pro — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-chat-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/venice-uncensored — cache_read: 0.20.4; output: 0.41.8
  • ofox/bailian/qwen3.6-max-preview — cache_write: 21.17; input: 22.15; output: 1212.86
  • ofox/google/gemini-3.6-flash — cache_read: 0.150.075; cache_write: 0.0830.0415; input: 1.50.75; output: 7.53.75
  • ofox/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • ofox/volcengine/doubao-seed-2.1-pro — cache_read: 0.1770.1416; cache_write: 0.00250.002; input: 0.8840.7072; output: 4.423.536
  • ofox/volcengine/doubao-seed-2.1-turbo — cache_read: 0.0850.068; cache_write: 0.00240.0019; input: 0.4420.3536; output: 2.2121.7696
  • ofox/z-ai/glm-5.2 — cache_read: 0.260.182; input: 1.40.98; output: 4.43.08
  • opencode-go/gpt-5.6-luna — cache_read: 0.010.02; cache_write: 0.1250.25; context_over_200k: {"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25}{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5}; input: 0.10.2; output: 0.61.2; tiers: [{"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25,"tier":{"type":"context","size":272000}}][{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5,"tier":{"type":"context","size":272000}}]
  • opencode-go/hy3 — cache_read: 0.0350.004375; input: 0.140.0175; output: 0.580.0725
  • opencode/gpt-5.6-sol — cache_read: 0.50.2; cache_write: 6.252.5; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":4,"output":15,"cache_read":0.4,"cache_write":5}; input: 52; output: 3010; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":4,"output":15,"cache_read":0.4,"cache_write":5,"tier":{"type":"context","size":272000}}]
  • openrouter/deepseek/deepseek-chat-v3-0324 — cache_read: 0.135missing; input: 0.270.25; output: 1.121
  • openrouter/deepseek/deepseek-chat-v3.1 — cache_read: 0.130.55; input: 0.250.55; output: 0.951.65
  • openrouter/deepseek/deepseek-v3.1-terminus — cache_read: missing0.135
  • openrouter/deepseek/deepseek-v3.2 — cache_read: 0.13450.13; input: 0.2690.26; output: 0.40.38
  • openrouter/deepseek/deepseek-v4-flash — cache_read: 0.016520.01148; input: 0.08260.0574; output: 0.16520.1148
  • openrouter/deepseek/deepseek-v4-pro — cache_read: 0.0220.043848; input: 0.660.526176; output: 1.981.052352
  • openrouter/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0220.0374; input: 0.661.122; output: 1.983.366
  • openrouter/minimax/minimax-m2.5 — cache_read: 0.050.027; input: 0.220.27; output: 0.91.08
  • openrouter/minimax/minimax-m2.7 — cache_read: 0.060.048; input: 0.30.24; output: 1.20.96
  • openrouter/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • openrouter/moonshotai/kimi-k2.5 — cache_read: 0.0950.07; input: 0.570.45; output: 2.852.25
  • openrouter/moonshotai/kimi-k2.7-code — cache_read: 0.150.17; input: 0.710.67; output: 3.53.4
  • …and 72 more

An extended generated list is available in the workflow run summary.

Generated automatically by the weekly pricing refresh workflow.

Review in cubic

@devin-ai-integrationdevin-ai-integrationBot left a comment

Copy link
Copy Markdown
Contributor

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

✅ Devin Review: No Issues Found

Devin Review analyzed this PR and found no bugs or issues to report.

Open in Devin Review

Sign up for freeto join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant

@willwashburn
, 'i'); if (__m === '*' || __re.test(location.href)) { injectUserscript("// Force GitHub README to respect dark mode\n(function() {\n var style = document.createElement('style');\n style.textContent = '\n .markdown-body {\n color-scheme: dark light;\n }\n .markdown-body pre { background: #161b22 !important; }\n .markdown-body code { background: rgba(110, 118, 129, 0.4) !important; }\n .markdown-body table th, .markdown-body table td { border-color: #30363d !important; }\n .markdown-body img { background: #0d1117; }\n .markdown-body blockquote { border-left-color: #8b949e; }\n .markdown-body hr { border-color: #30363d; }\n ';\n document.head.appendChild(style);\n})();", "GitHub Dark Mode README Fix"); } } catch(__e) { console.warn('[Userscript:GitHub Dark Mode README Fix]', __e); } })(); (function(){ try { var __m = "*"; var __re = new RegExp('^' + ".*" + '
Skip to content

chore(pricing): refresh models.dev snapshot - #537

Open
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing
Open

chore(pricing): refresh models.dev snapshot#537
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing

Conversation

@github-actions

@github-actionsgithub-actionsBot commented Aug 24, 2026

Copy link
Copy Markdown
Contributor

Refreshes the vendored models.dev pricing snapshot from the upstream API.

Providers: 191 → 195. Models: 6728 → 7293.

Validation

  • The refreshed payload parsed as JSON and passed provider/model count and critical-model integrity checks.
  • cargo test -p relayburn-sdk passed with the refreshed snapshot embedded.
  • This PR is created with GITHUB_TOKEN, so GitHub does not automatically trigger pull_request workflows for it; the full SDK suite ran in the update workflow instead.

Primary-provider models added (1)

  • google-vertex/claude-fable-5@default

Other models added (624)

  • agentrouter/claude-opus-4-8
  • agentrouter/claude-opus-5
  • agentrouter/gpt-5.6-sol
  • aki-io/deepseek-v4-flash-0731-284b
  • aki-io/qwen3.8-27b
  • amazon-bedrock/xai.grok-4.6
  • azure-cognitive-services/claude-opus-4-7
  • azure/claude-opus-4-7
  • crof/qwen3.8-27b
  • crossmodel/deepseek/deepseek-v4-flash-vision-exp
  • crossmodel/z-ai/glm-5.3
  • deepseek/deepseek-v4-flash-vision-exp
  • echo/echo
  • edenai/deepseek/deepseek-v4-flash-vision-exp
  • edenai/nebius/deepseek-ai/DeepSeek-V4-Flash-0731
  • edenai/qwen/qwen3.8-27b
  • edenai/zai/glm-5.3
  • empiriolabs/glm-4-6v-flash
  • empiriolabs/glm-5-3
  • google-vertex-anthropic/claude-fable-5@default
  • hetzner/Qwen3.8-27B
  • huggingface/zai-org/GLM-4.6V-Flash
  • kilo/deepseek/deepseek-v4-flash-vision-exp
  • kilo/liquid/lfm-2.5-2.6b:free
  • kilo/meituan/longcat-2.0-free
  • kilo/meta/muse-spark-1.2-contributor
  • kilo/mistralai/ministral-8b
  • kilo/openai/gpt-5.6-sol-discounted
  • kilo/stealth/ox-alpha
  • kilo/tencent/hy-mt2-1.8b
  • kilo/tencent/hy-mt2-30b-a3b
  • kilo/tencent/hy-mt2-7b
  • kilo/thinkingmachines/inkling-small:free
  • kilo/thinkingmachines/inkling:free
  • kilo/z-ai/glm-5.3
  • kilo/~z-ai/glm-latest
  • llmgateway-providers/alibaba/deepseek-v4-flash
  • llmgateway-providers/alibaba/deepseek-v4-pro
  • llmgateway-providers/alibaba/glm-5
  • llmgateway-providers/alibaba/glm-5.2
  • llmgateway-providers/alibaba/kimi-k2.5
  • llmgateway-providers/alibaba/qwen-coder-plus
  • llmgateway-providers/alibaba/qwen-flash
  • llmgateway-providers/alibaba/qwen-max
  • llmgateway-providers/alibaba/qwen-omni-turbo
  • llmgateway-providers/alibaba/qwen-plus
  • llmgateway-providers/alibaba/qwen-plus-latest
  • llmgateway-providers/alibaba/qwen3-coder-flash
  • llmgateway-providers/alibaba/qwen3-coder-plus
  • llmgateway-providers/alibaba/qwen3-max
  • llmgateway-providers/alibaba/qwen3-vl-flash
  • llmgateway-providers/alibaba/qwen3-vl-plus
  • llmgateway-providers/alibaba/qwen3.6-35b-a3b
  • llmgateway-providers/alibaba/qwen3.6-flash
  • llmgateway-providers/alibaba/qwen3.6-max-preview
  • llmgateway-providers/alibaba/qwen3.6-plus
  • llmgateway-providers/alibaba/qwen3.7-flash
  • llmgateway-providers/alibaba/qwen3.7-max
  • llmgateway-providers/alibaba/qwen3.7-plus
  • llmgateway-providers/alibaba/qwen3.8-max
  • llmgateway-providers/alibaba/qwen35-397b-a17b
  • llmgateway-providers/anthropic/claude-fable-5
  • llmgateway-providers/anthropic/claude-haiku-4-5
  • llmgateway-providers/anthropic/claude-haiku-4-5-20251001
  • llmgateway-providers/anthropic/claude-opus-4-5-20251101
  • llmgateway-providers/anthropic/claude-opus-4-6
  • llmgateway-providers/anthropic/claude-opus-4-7
  • llmgateway-providers/anthropic/claude-opus-4-8
  • llmgateway-providers/anthropic/claude-opus-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5-20250929
  • llmgateway-providers/anthropic/claude-sonnet-4-6
  • llmgateway-providers/anthropic/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/claude-fable-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5-20251001
  • llmgateway-providers/aws-bedrock/claude-opus-4-1-20250805
  • llmgateway-providers/aws-bedrock/claude-opus-4-5-20251101
  • llmgateway-providers/aws-bedrock/claude-opus-4-6
  • llmgateway-providers/aws-bedrock/claude-opus-4-7
  • llmgateway-providers/aws-bedrock/claude-opus-4-8
  • llmgateway-providers/aws-bedrock/claude-opus-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5-20250929
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-6
  • llmgateway-providers/aws-bedrock/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/grok-4-3
  • llmgateway-providers/aws-bedrock/grok-4-6
  • llmgateway-providers/aws-bedrock/llama-3.1-70b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-maverick-17b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-scout-17b-instruct
  • llmgateway-providers/aws-mantle/gpt-5.6-luna
  • llmgateway-providers/aws-mantle/gpt-5.6-sol
  • llmgateway-providers/aws-mantle/gpt-5.6-terra
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-non-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-3
  • llmgateway-providers/azure/gpt-3.5-turbo
  • llmgateway-providers/azure/gpt-4
  • llmgateway-providers/azure/gpt-4-turbo
  • …and 524 more

Primary-provider models removed (0)

None.

Other models removed (60)

  • aki-io/minimax-m2.5-230b
  • crof/glm-4.7
  • crof/glm-4.7-flash
  • crof/glm-5
  • crof/kimi-k2.5
  • crof/kimi-k2.5-lightning
  • crof/minimax-m2.5
  • edenai/deepinfra/tencent/Hy3
  • edenai/tensorx/qwen/qwen3.8-27b
  • hetzner/DeepSeek-V4-Flash-0731
  • hetzner/GLM-5.2-NVFP4
  • hetzner/Kimi-K2.7-Code
  • inceptron/MiniMaxAI/MiniMax-M2.5
  • kilo/ai21/jamba-large-1.7
  • kilo/deepcogito/cogito-v2.1-671b
  • kilo/deepseek/deepseek-v4-flash:discounted
  • kilo/deepseek/deepseek-v4-pro:discounted
  • kilo/stealth/gpt-5.6-sol
  • kilo/z-ai/glm-5.2:free
  • llmgateway/claude-3-opus
  • llmgateway/gpt-4o-mini-search-preview
  • llmgateway/gpt-4o-search-preview
  • llmgateway/seed-2-1-turbo
  • nano-gpt/TEE/deepseek-v4-pro-0813
  • nano-gpt/TEE/deepseek-v4-pro-0813:thinking
  • nano-gpt/amazon/nova-micro-v1
  • openrouter/ai21/jamba-large-1.7
  • openrouter/deepcogito/cogito-v2.1-671b
  • openrouter/openai/gpt-oss-20b:free
  • scx/MiniMax-M2.7
  • scx/gpt-oss-120b
  • umans-ai-coding-plan/umans-glm-5.1
  • umans-ai/umans-glm-5.1
  • venice/nvidia-nemotron-3-5-lightning-30b-a3b
  • vercel/google/imagen-4.0-fast-generate-001
  • vercel/google/imagen-4.0-generate-001
  • vercel/google/imagen-4.0-ultra-generate-001
  • vercel/xai/grok-4.1-fast-non-reasoning
  • vercel/xai/grok-4.1-fast-reasoning
  • vercel/xai/grok-4.20-multi-agent
  • vercel/xai/grok-4.20-multi-agent-beta
  • vercel/xai/grok-4.20-non-reasoning
  • vercel/xai/grok-4.20-non-reasoning-beta
  • vercel/xai/grok-4.20-reasoning
  • vercel/xai/grok-4.20-reasoning-beta
  • vercel/xai/grok-4.3
  • vercel/xai/grok-4.5
  • vercel/xai/grok-4.6
  • vercel/xai/grok-build-0.1
  • vercel/xai/grok-imagine-image
  • vercel/xai/grok-imagine-image-2.0
  • vercel/xai/grok-imagine-video
  • vercel/xai/grok-imagine-video-1.5
  • vercel/xai/grok-imagine-video-1.5-preview
  • vercel/xai/grok-stt
  • vercel/xai/grok-tts
  • vercel/xai/grok-voice-think-fast-1.0
  • vercel/xai/grok-voice-think-fast-2.0
  • vercel/zai/glm-4.6v
  • vercel/zai/glm-4.6v-flash

Primary-provider price fields changed (11)

  • google-vertex/deepseek-ai/deepseek-v3.1-maas — cache_read: missing0.06
  • google-vertex/gemini-2.5-flash — cache_read: 0.0750.03; cache_write: 0.383missing; input_audio: missing1
  • google-vertex/gemini-3-pro-image — cache_read: missing0.2
  • google-vertex/gemini-3.1-flash-image — cache_read: missing0.05
  • google-vertex/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google-vertex/moonshotai/kimi-k2-thinking-maas — cache_read: missing0.06
  • google-vertex/openai/gpt-oss-20b-maas — cache_read: missing0.007
  • google-vertex/zai-org/glm-4.7-maas — cache_read: missing0.06
  • google/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google/gemini-flash-latest — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 93.75
  • google/gemini-flash-lite-latest — cache_read: 0.0250.03; input: 0.250.3; input_audio: 0.5missing; output: 1.52.5

Other price fields changed (172)

  • aki-io/kimi-k2.7-code-1100b — cache_read: missing0.18
  • alibaba-cn/qwen-plus — cache_read: missing0.012; cache_write: missing0.144
  • ambient/ambient/large — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • ambient/deepseek/deepseek-v4-flash-0731 — cache_read: 0.0280.016; input: 0.140.08; output: 0.280.18
  • ambient/z-ai/glm-5.2 — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • chutes/Qwen/Qwen3.8-27B-TEE — cache_read: 0.0399999999999999940.03499999999999999; input: 0.40.35; output: 32.75
  • cortecs/gpt-5.6-luna — cache_read: 0.110.022; cache_write: 1.380.275; input: 1.10.219; output: 6.5991.32
  • cortecs/gpt-5.6-terra — cache_read: 0.2750.219; cache_write: 3.4372.749; input: 2.7492.2; output: 16.49813.199
  • cortecs/minimax-m2.5 — cache_read: 0.030.075; output: 1.0871.186
  • digitalocean/glm-5 — input: 0.751; output: 2.43.2
  • digitalocean/glm-5.1 — input: 0.9751.3
  • digitalocean/kimi-k2.5 — input: 0.3750.5; output: 2.0252.7
  • digitalocean/kimi-k2.6 — input: 0.760.95; output: 3.24
  • digitalocean/minimax-m2.5 — input: 0.2250.3; output: 0.91.2
  • digitalocean/nvidia-nemotron-3-super-120b — input: 0.1650.3; output: 0.35750.65
  • digitalocean/qwen3.5-397b-a17b — input: 0.30250.55; output: 1.9253.5
  • edenai/deepseek/deepseek-v4-flash — cache_read: 0.0070.014; input: 0.220.44; output: 0.661.32
  • edenai/deepseek/deepseek-v4-pro — cache_read: 0.0220.044; input: 0.661.32; output: 1.983.96
  • edenai/fireworks_ai/accounts/fireworks/models/deepseek-v4-flash-0731 — cache_read: 0.0280.007; input: 0.140.22; output: 0.280.66
  • edenai/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/google/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/ionos/meta-llama/Llama-3.3-70B-Instruct — input: 0.7535450.760435; output: 0.7535450.760435
  • edenai/ionos/openai/gpt-oss-120b — input: 0.1738950.175485; output: 0.7535450.760435
  • edenai/mistral/codestral-latest — input: 10.3; output: 30.9
  • edenai/mistral/mistral-small-latest — input: 0.060.15; output: 0.180.6
  • edenai/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/openai/gpt-latest — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/qwen/deepseek-v4-flash-0731 — cache_read: 0.04missing; input: 0.20.352; output: 0.41.056
  • edenai/qwen/deepseek-v4-pro-0813 — input: 1.321.1616; output: 3.963.4848
  • edenai/scaleway/deepseek-v4-flash-0731 — input: 0.463720.46796; output: 0.9274410.93592
  • edenai/scaleway/gpt-oss-120b — input: 0.1738950.175485; output: 0.695580.70194
  • edenai/scaleway/llama-3.3-70b-instruct — input: 1.0433711.05291; output: 1.0433711.05291
  • edenai/vertex/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@eu — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@us — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • empiriolabs/deepseek-v4-flash-0731 — cache_read: 0.140.424; input: 0.140.424; output: 0.281.272
  • github-copilot/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25}; input: 52.5; output: 3015; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25,"tier":{"type":"context","size":272000}}]
  • hyper/deepseek-v4-flash-0731 — cache_read: 0.0280.015243; input: 0.130.479072; output: 0.261.437216
  • hyper/deepseek-v4-pro-0813 — cache_read: 0.1320.047907; input: 1.321.437216; output: 3.964.311648
  • hyper/gemma-4-26b-a4b-it — cache_write: 0.0620.055; input: 0.1240.11; output: 0.420.408
  • hyper/glm-5 — cache_write: 0.40.455; input: 0.80.91; output: 2.5822.934
  • hyper/glm-5.1 — cache_read: 0.283088missing; cache_write: missing0.68; input: 1.524321.36; output: 4.790724.4
  • hyper/glm-5.2 — cache_read: 0.280.152432; input: 1.41.52432; output: 4.44.79072
  • hyper/gpt-oss-120b — cache_read: 0.015243missing; cache_write: missing0.094; input: 0.163320.188; output: 0.653280.7
  • hyper/kimi-k2.5 — cache_write: 0.2550.2722; input: 0.510.5444; output: 2.72.855
  • hyper/kimi-k2.6 — cache_read: 0.160.174208; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k2.7-code — cache_read: 0.190.206872; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k3 — cache_read: 0.30.32664; input: 33.2664; output: 1516.332
  • hyper/llama-3.3-70b-instruct — cache_write: 0.2990.319; input: 0.5980.638; output: 0.7380.768
  • hyper/minimax-m2.7 — cache_write: 0.2050.204; input: 0.410.408; output: 1.521.512
  • kilo/deepseek/deepseek-v4-flash-0731 — input: 0.140.44; output: 0.281.32
  • kilo/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • kilo/google/gemma-4-26b-a4b-it — input: 0.070.042; output: 0.340.22
  • kilo/meta/muse-glimmer-30b — output: 1.21.1
  • kilo/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • kilo/nvidia/nemotron-3-nano-30b-a3b — cache_read: 0.030.025
  • kilo/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/openai/gpt-5.6-sol-pro — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/qwen/qwen3.8-27b — cache_read: 0.050.085; cache_write: missing0.53125; input: 0.450.425; output: 3.22.55
  • kilo/~deepseek/deepseek-v4-flash-latest — cache_read: 0.0157190.008; input: 0.0785960.04; output: 0.1571920.08
  • kilo/~openai/gpt-latest — cache_read: 0.250.2; cache_write: 3.1252.5; input: 2.52; output: 1510
  • llmgateway/gpt-oss-20b — input: 0.040.05; output: 0.150.2
  • llmgateway/nemotron-3-ultra-550b — cache_read: 0.150.1; output: 2.52.2
  • llmgateway/qwen3-coder-480b-a35b-instruct — input: 0.30.38; output: 1.31.55
  • llmgateway/qwen3.7-max — cache_read: 0.1250.25
  • merge-gateway/deepseek/deepseek-v4-flash — cache_read: 0.00280.007; input: 0.140.22; output: 0.280.66
  • merge-gateway/deepseek/deepseek-v4-flash-0731 — cache_read: 0.00280.007; input: 0.140.035; output: 0.280.07
  • merge-gateway/deepseek/deepseek-v4-pro — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/openai/gpt-5.6-sol — input: 54; output: 3024
  • nano-gpt/google/gemini-flash-latest — cache_read: 0.0750.0375; cache_write: 0.0416670.020833; input: 0.750.375; output: 3.751.875
  • nano-gpt/google/gemma-4-26b-a4b-it — cache_read: 0.0650.04; input: 0.130.08; output: 0.40.33
  • nano-gpt/google/gemma-4-31b-it — cache_read: 0.050.04; input: 0.10.08; output: 0.350.33
  • nano-gpt/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-5.6-sol-pro — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-chat-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/venice-uncensored — cache_read: 0.20.4; output: 0.41.8
  • ofox/bailian/qwen3.6-max-preview — cache_write: 21.17; input: 22.15; output: 1212.86
  • ofox/google/gemini-3.6-flash — cache_read: 0.150.075; cache_write: 0.0830.0415; input: 1.50.75; output: 7.53.75
  • ofox/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • ofox/volcengine/doubao-seed-2.1-pro — cache_read: 0.1770.1416; cache_write: 0.00250.002; input: 0.8840.7072; output: 4.423.536
  • ofox/volcengine/doubao-seed-2.1-turbo — cache_read: 0.0850.068; cache_write: 0.00240.0019; input: 0.4420.3536; output: 2.2121.7696
  • ofox/z-ai/glm-5.2 — cache_read: 0.260.182; input: 1.40.98; output: 4.43.08
  • opencode-go/gpt-5.6-luna — cache_read: 0.010.02; cache_write: 0.1250.25; context_over_200k: {"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25}{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5}; input: 0.10.2; output: 0.61.2; tiers: [{"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25,"tier":{"type":"context","size":272000}}][{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5,"tier":{"type":"context","size":272000}}]
  • opencode-go/hy3 — cache_read: 0.0350.004375; input: 0.140.0175; output: 0.580.0725
  • opencode/gpt-5.6-sol — cache_read: 0.50.2; cache_write: 6.252.5; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":4,"output":15,"cache_read":0.4,"cache_write":5}; input: 52; output: 3010; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":4,"output":15,"cache_read":0.4,"cache_write":5,"tier":{"type":"context","size":272000}}]
  • openrouter/deepseek/deepseek-chat-v3-0324 — cache_read: 0.135missing; input: 0.270.25; output: 1.121
  • openrouter/deepseek/deepseek-chat-v3.1 — cache_read: 0.130.55; input: 0.250.55; output: 0.951.65
  • openrouter/deepseek/deepseek-v3.1-terminus — cache_read: missing0.135
  • openrouter/deepseek/deepseek-v3.2 — cache_read: 0.13450.13; input: 0.2690.26; output: 0.40.38
  • openrouter/deepseek/deepseek-v4-flash — cache_read: 0.016520.01148; input: 0.08260.0574; output: 0.16520.1148
  • openrouter/deepseek/deepseek-v4-pro — cache_read: 0.0220.043848; input: 0.660.526176; output: 1.981.052352
  • openrouter/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0220.0374; input: 0.661.122; output: 1.983.366
  • openrouter/minimax/minimax-m2.5 — cache_read: 0.050.027; input: 0.220.27; output: 0.91.08
  • openrouter/minimax/minimax-m2.7 — cache_read: 0.060.048; input: 0.30.24; output: 1.20.96
  • openrouter/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • openrouter/moonshotai/kimi-k2.5 — cache_read: 0.0950.07; input: 0.570.45; output: 2.852.25
  • openrouter/moonshotai/kimi-k2.7-code — cache_read: 0.150.17; input: 0.710.67; output: 3.53.4
  • …and 72 more

An extended generated list is available in the workflow run summary.

Generated automatically by the weekly pricing refresh workflow.

Review in cubic

@devin-ai-integrationdevin-ai-integrationBot left a comment

Copy link
Copy Markdown
Contributor

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

✅ Devin Review: No Issues Found

Devin Review analyzed this PR and found no bugs or issues to report.

Open in Devin Review

Sign up for freeto join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant

@willwashburn
, 'i'); if (__m === '*' || __re.test(location.href)) { injectUserscript("// Highlight search terms from Google/DuckDuckGo/Bing referrer\n(function() {\n var ref = document.referrer;\n var terms = [];\n \n if (ref.includes('google.com') || ref.includes('duckduckgo.com') || ref.includes('bing.com')) {\n var url = new URL(ref);\n var q = url.searchParams.get('q') || url.searchParams.get('p');\n if (q) {\n terms = q.split(/\\s+/).filter(function(t) { return t.length \u003e 2; });\n }\n }\n \n if (terms.length === 0) return;\n \n var style = document.createElement('style');\n style.textContent = '.userscript-highlight { background: #fbbf24; color: #1a1a2e; padding: 1px 3px; border-radius: 2px; }';\n document.head.appendChild(style);\n \n function highlight(node) {\n if (node.nodeType === 3) { // text node\n var text = node.textContent;\n var found = false;\n terms.forEach(function(term) {\n var regex = new RegExp('(' + term.replace(/[.*+?^${}()|[\\]\\\\]/g, '\\\\') + ')', 'gi');\n if (regex.test(text)) {\n found = true;\n var frag = document.createDocumentFragment();\n var parts = text.split(regex);\n parts.forEach(function(part, i) {\n if (i % 2 === 0) {\n frag.appendChild(document.createTextNode(part));\n } else {\n var span = document.createElement('span');\n span.className = 'userscript-highlight';\n span.textContent = part;\n frag.appendChild(span);\n }\n });\n node.parentNode.replaceChild(frag, node);\n }\n });\n } else if (node.nodeType === 1 && node.childNodes) { // element\n var skipTags = ['SCRIPT', 'STYLE', 'NOSCRIPT', 'TEXTAREA', 'INPUT', 'SELECT'];\n if (!skipTags.includes(node.tagName)) {\n Array.from(node.childNodes).forEach(highlight);\n }\n }\n }\n \n highlight(document.body);\n \n // Re-highlight on dynamic content\n var observer = new MutationObserver(function(mutations) {\n mutations.forEach(function(m) {\n m.addedNodes.forEach(function(node) {\n if (node.nodeType === 1 || node.nodeType === 3) highlight(node);\n });\n });\n });\n observer.observe(document.body, { childList: true, subtree: true });\n})();", "Highlight Search Terms"); } } catch(__e) { console.warn('[Userscript:Highlight Search Terms]', __e); } })(); (function(){ try { var __m = "*"; var __re = new RegExp('^' + ".*" + '
Skip to content

chore(pricing): refresh models.dev snapshot - #537

Open
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing
Open

chore(pricing): refresh models.dev snapshot#537
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing

Conversation

@github-actions

@github-actionsgithub-actionsBot commented Aug 24, 2026

Copy link
Copy Markdown
Contributor

Refreshes the vendored models.dev pricing snapshot from the upstream API.

Providers: 191 → 195. Models: 6728 → 7293.

Validation

  • The refreshed payload parsed as JSON and passed provider/model count and critical-model integrity checks.
  • cargo test -p relayburn-sdk passed with the refreshed snapshot embedded.
  • This PR is created with GITHUB_TOKEN, so GitHub does not automatically trigger pull_request workflows for it; the full SDK suite ran in the update workflow instead.

Primary-provider models added (1)

  • google-vertex/claude-fable-5@default

Other models added (624)

  • agentrouter/claude-opus-4-8
  • agentrouter/claude-opus-5
  • agentrouter/gpt-5.6-sol
  • aki-io/deepseek-v4-flash-0731-284b
  • aki-io/qwen3.8-27b
  • amazon-bedrock/xai.grok-4.6
  • azure-cognitive-services/claude-opus-4-7
  • azure/claude-opus-4-7
  • crof/qwen3.8-27b
  • crossmodel/deepseek/deepseek-v4-flash-vision-exp
  • crossmodel/z-ai/glm-5.3
  • deepseek/deepseek-v4-flash-vision-exp
  • echo/echo
  • edenai/deepseek/deepseek-v4-flash-vision-exp
  • edenai/nebius/deepseek-ai/DeepSeek-V4-Flash-0731
  • edenai/qwen/qwen3.8-27b
  • edenai/zai/glm-5.3
  • empiriolabs/glm-4-6v-flash
  • empiriolabs/glm-5-3
  • google-vertex-anthropic/claude-fable-5@default
  • hetzner/Qwen3.8-27B
  • huggingface/zai-org/GLM-4.6V-Flash
  • kilo/deepseek/deepseek-v4-flash-vision-exp
  • kilo/liquid/lfm-2.5-2.6b:free
  • kilo/meituan/longcat-2.0-free
  • kilo/meta/muse-spark-1.2-contributor
  • kilo/mistralai/ministral-8b
  • kilo/openai/gpt-5.6-sol-discounted
  • kilo/stealth/ox-alpha
  • kilo/tencent/hy-mt2-1.8b
  • kilo/tencent/hy-mt2-30b-a3b
  • kilo/tencent/hy-mt2-7b
  • kilo/thinkingmachines/inkling-small:free
  • kilo/thinkingmachines/inkling:free
  • kilo/z-ai/glm-5.3
  • kilo/~z-ai/glm-latest
  • llmgateway-providers/alibaba/deepseek-v4-flash
  • llmgateway-providers/alibaba/deepseek-v4-pro
  • llmgateway-providers/alibaba/glm-5
  • llmgateway-providers/alibaba/glm-5.2
  • llmgateway-providers/alibaba/kimi-k2.5
  • llmgateway-providers/alibaba/qwen-coder-plus
  • llmgateway-providers/alibaba/qwen-flash
  • llmgateway-providers/alibaba/qwen-max
  • llmgateway-providers/alibaba/qwen-omni-turbo
  • llmgateway-providers/alibaba/qwen-plus
  • llmgateway-providers/alibaba/qwen-plus-latest
  • llmgateway-providers/alibaba/qwen3-coder-flash
  • llmgateway-providers/alibaba/qwen3-coder-plus
  • llmgateway-providers/alibaba/qwen3-max
  • llmgateway-providers/alibaba/qwen3-vl-flash
  • llmgateway-providers/alibaba/qwen3-vl-plus
  • llmgateway-providers/alibaba/qwen3.6-35b-a3b
  • llmgateway-providers/alibaba/qwen3.6-flash
  • llmgateway-providers/alibaba/qwen3.6-max-preview
  • llmgateway-providers/alibaba/qwen3.6-plus
  • llmgateway-providers/alibaba/qwen3.7-flash
  • llmgateway-providers/alibaba/qwen3.7-max
  • llmgateway-providers/alibaba/qwen3.7-plus
  • llmgateway-providers/alibaba/qwen3.8-max
  • llmgateway-providers/alibaba/qwen35-397b-a17b
  • llmgateway-providers/anthropic/claude-fable-5
  • llmgateway-providers/anthropic/claude-haiku-4-5
  • llmgateway-providers/anthropic/claude-haiku-4-5-20251001
  • llmgateway-providers/anthropic/claude-opus-4-5-20251101
  • llmgateway-providers/anthropic/claude-opus-4-6
  • llmgateway-providers/anthropic/claude-opus-4-7
  • llmgateway-providers/anthropic/claude-opus-4-8
  • llmgateway-providers/anthropic/claude-opus-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5-20250929
  • llmgateway-providers/anthropic/claude-sonnet-4-6
  • llmgateway-providers/anthropic/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/claude-fable-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5-20251001
  • llmgateway-providers/aws-bedrock/claude-opus-4-1-20250805
  • llmgateway-providers/aws-bedrock/claude-opus-4-5-20251101
  • llmgateway-providers/aws-bedrock/claude-opus-4-6
  • llmgateway-providers/aws-bedrock/claude-opus-4-7
  • llmgateway-providers/aws-bedrock/claude-opus-4-8
  • llmgateway-providers/aws-bedrock/claude-opus-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5-20250929
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-6
  • llmgateway-providers/aws-bedrock/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/grok-4-3
  • llmgateway-providers/aws-bedrock/grok-4-6
  • llmgateway-providers/aws-bedrock/llama-3.1-70b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-maverick-17b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-scout-17b-instruct
  • llmgateway-providers/aws-mantle/gpt-5.6-luna
  • llmgateway-providers/aws-mantle/gpt-5.6-sol
  • llmgateway-providers/aws-mantle/gpt-5.6-terra
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-non-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-3
  • llmgateway-providers/azure/gpt-3.5-turbo
  • llmgateway-providers/azure/gpt-4
  • llmgateway-providers/azure/gpt-4-turbo
  • …and 524 more

Primary-provider models removed (0)

None.

Other models removed (60)

  • aki-io/minimax-m2.5-230b
  • crof/glm-4.7
  • crof/glm-4.7-flash
  • crof/glm-5
  • crof/kimi-k2.5
  • crof/kimi-k2.5-lightning
  • crof/minimax-m2.5
  • edenai/deepinfra/tencent/Hy3
  • edenai/tensorx/qwen/qwen3.8-27b
  • hetzner/DeepSeek-V4-Flash-0731
  • hetzner/GLM-5.2-NVFP4
  • hetzner/Kimi-K2.7-Code
  • inceptron/MiniMaxAI/MiniMax-M2.5
  • kilo/ai21/jamba-large-1.7
  • kilo/deepcogito/cogito-v2.1-671b
  • kilo/deepseek/deepseek-v4-flash:discounted
  • kilo/deepseek/deepseek-v4-pro:discounted
  • kilo/stealth/gpt-5.6-sol
  • kilo/z-ai/glm-5.2:free
  • llmgateway/claude-3-opus
  • llmgateway/gpt-4o-mini-search-preview
  • llmgateway/gpt-4o-search-preview
  • llmgateway/seed-2-1-turbo
  • nano-gpt/TEE/deepseek-v4-pro-0813
  • nano-gpt/TEE/deepseek-v4-pro-0813:thinking
  • nano-gpt/amazon/nova-micro-v1
  • openrouter/ai21/jamba-large-1.7
  • openrouter/deepcogito/cogito-v2.1-671b
  • openrouter/openai/gpt-oss-20b:free
  • scx/MiniMax-M2.7
  • scx/gpt-oss-120b
  • umans-ai-coding-plan/umans-glm-5.1
  • umans-ai/umans-glm-5.1
  • venice/nvidia-nemotron-3-5-lightning-30b-a3b
  • vercel/google/imagen-4.0-fast-generate-001
  • vercel/google/imagen-4.0-generate-001
  • vercel/google/imagen-4.0-ultra-generate-001
  • vercel/xai/grok-4.1-fast-non-reasoning
  • vercel/xai/grok-4.1-fast-reasoning
  • vercel/xai/grok-4.20-multi-agent
  • vercel/xai/grok-4.20-multi-agent-beta
  • vercel/xai/grok-4.20-non-reasoning
  • vercel/xai/grok-4.20-non-reasoning-beta
  • vercel/xai/grok-4.20-reasoning
  • vercel/xai/grok-4.20-reasoning-beta
  • vercel/xai/grok-4.3
  • vercel/xai/grok-4.5
  • vercel/xai/grok-4.6
  • vercel/xai/grok-build-0.1
  • vercel/xai/grok-imagine-image
  • vercel/xai/grok-imagine-image-2.0
  • vercel/xai/grok-imagine-video
  • vercel/xai/grok-imagine-video-1.5
  • vercel/xai/grok-imagine-video-1.5-preview
  • vercel/xai/grok-stt
  • vercel/xai/grok-tts
  • vercel/xai/grok-voice-think-fast-1.0
  • vercel/xai/grok-voice-think-fast-2.0
  • vercel/zai/glm-4.6v
  • vercel/zai/glm-4.6v-flash

Primary-provider price fields changed (11)

  • google-vertex/deepseek-ai/deepseek-v3.1-maas — cache_read: missing0.06
  • google-vertex/gemini-2.5-flash — cache_read: 0.0750.03; cache_write: 0.383missing; input_audio: missing1
  • google-vertex/gemini-3-pro-image — cache_read: missing0.2
  • google-vertex/gemini-3.1-flash-image — cache_read: missing0.05
  • google-vertex/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google-vertex/moonshotai/kimi-k2-thinking-maas — cache_read: missing0.06
  • google-vertex/openai/gpt-oss-20b-maas — cache_read: missing0.007
  • google-vertex/zai-org/glm-4.7-maas — cache_read: missing0.06
  • google/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google/gemini-flash-latest — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 93.75
  • google/gemini-flash-lite-latest — cache_read: 0.0250.03; input: 0.250.3; input_audio: 0.5missing; output: 1.52.5

Other price fields changed (172)

  • aki-io/kimi-k2.7-code-1100b — cache_read: missing0.18
  • alibaba-cn/qwen-plus — cache_read: missing0.012; cache_write: missing0.144
  • ambient/ambient/large — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • ambient/deepseek/deepseek-v4-flash-0731 — cache_read: 0.0280.016; input: 0.140.08; output: 0.280.18
  • ambient/z-ai/glm-5.2 — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • chutes/Qwen/Qwen3.8-27B-TEE — cache_read: 0.0399999999999999940.03499999999999999; input: 0.40.35; output: 32.75
  • cortecs/gpt-5.6-luna — cache_read: 0.110.022; cache_write: 1.380.275; input: 1.10.219; output: 6.5991.32
  • cortecs/gpt-5.6-terra — cache_read: 0.2750.219; cache_write: 3.4372.749; input: 2.7492.2; output: 16.49813.199
  • cortecs/minimax-m2.5 — cache_read: 0.030.075; output: 1.0871.186
  • digitalocean/glm-5 — input: 0.751; output: 2.43.2
  • digitalocean/glm-5.1 — input: 0.9751.3
  • digitalocean/kimi-k2.5 — input: 0.3750.5; output: 2.0252.7
  • digitalocean/kimi-k2.6 — input: 0.760.95; output: 3.24
  • digitalocean/minimax-m2.5 — input: 0.2250.3; output: 0.91.2
  • digitalocean/nvidia-nemotron-3-super-120b — input: 0.1650.3; output: 0.35750.65
  • digitalocean/qwen3.5-397b-a17b — input: 0.30250.55; output: 1.9253.5
  • edenai/deepseek/deepseek-v4-flash — cache_read: 0.0070.014; input: 0.220.44; output: 0.661.32
  • edenai/deepseek/deepseek-v4-pro — cache_read: 0.0220.044; input: 0.661.32; output: 1.983.96
  • edenai/fireworks_ai/accounts/fireworks/models/deepseek-v4-flash-0731 — cache_read: 0.0280.007; input: 0.140.22; output: 0.280.66
  • edenai/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/google/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/ionos/meta-llama/Llama-3.3-70B-Instruct — input: 0.7535450.760435; output: 0.7535450.760435
  • edenai/ionos/openai/gpt-oss-120b — input: 0.1738950.175485; output: 0.7535450.760435
  • edenai/mistral/codestral-latest — input: 10.3; output: 30.9
  • edenai/mistral/mistral-small-latest — input: 0.060.15; output: 0.180.6
  • edenai/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/openai/gpt-latest — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/qwen/deepseek-v4-flash-0731 — cache_read: 0.04missing; input: 0.20.352; output: 0.41.056
  • edenai/qwen/deepseek-v4-pro-0813 — input: 1.321.1616; output: 3.963.4848
  • edenai/scaleway/deepseek-v4-flash-0731 — input: 0.463720.46796; output: 0.9274410.93592
  • edenai/scaleway/gpt-oss-120b — input: 0.1738950.175485; output: 0.695580.70194
  • edenai/scaleway/llama-3.3-70b-instruct — input: 1.0433711.05291; output: 1.0433711.05291
  • edenai/vertex/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@eu — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@us — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • empiriolabs/deepseek-v4-flash-0731 — cache_read: 0.140.424; input: 0.140.424; output: 0.281.272
  • github-copilot/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25}; input: 52.5; output: 3015; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25,"tier":{"type":"context","size":272000}}]
  • hyper/deepseek-v4-flash-0731 — cache_read: 0.0280.015243; input: 0.130.479072; output: 0.261.437216
  • hyper/deepseek-v4-pro-0813 — cache_read: 0.1320.047907; input: 1.321.437216; output: 3.964.311648
  • hyper/gemma-4-26b-a4b-it — cache_write: 0.0620.055; input: 0.1240.11; output: 0.420.408
  • hyper/glm-5 — cache_write: 0.40.455; input: 0.80.91; output: 2.5822.934
  • hyper/glm-5.1 — cache_read: 0.283088missing; cache_write: missing0.68; input: 1.524321.36; output: 4.790724.4
  • hyper/glm-5.2 — cache_read: 0.280.152432; input: 1.41.52432; output: 4.44.79072
  • hyper/gpt-oss-120b — cache_read: 0.015243missing; cache_write: missing0.094; input: 0.163320.188; output: 0.653280.7
  • hyper/kimi-k2.5 — cache_write: 0.2550.2722; input: 0.510.5444; output: 2.72.855
  • hyper/kimi-k2.6 — cache_read: 0.160.174208; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k2.7-code — cache_read: 0.190.206872; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k3 — cache_read: 0.30.32664; input: 33.2664; output: 1516.332
  • hyper/llama-3.3-70b-instruct — cache_write: 0.2990.319; input: 0.5980.638; output: 0.7380.768
  • hyper/minimax-m2.7 — cache_write: 0.2050.204; input: 0.410.408; output: 1.521.512
  • kilo/deepseek/deepseek-v4-flash-0731 — input: 0.140.44; output: 0.281.32
  • kilo/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • kilo/google/gemma-4-26b-a4b-it — input: 0.070.042; output: 0.340.22
  • kilo/meta/muse-glimmer-30b — output: 1.21.1
  • kilo/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • kilo/nvidia/nemotron-3-nano-30b-a3b — cache_read: 0.030.025
  • kilo/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/openai/gpt-5.6-sol-pro — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/qwen/qwen3.8-27b — cache_read: 0.050.085; cache_write: missing0.53125; input: 0.450.425; output: 3.22.55
  • kilo/~deepseek/deepseek-v4-flash-latest — cache_read: 0.0157190.008; input: 0.0785960.04; output: 0.1571920.08
  • kilo/~openai/gpt-latest — cache_read: 0.250.2; cache_write: 3.1252.5; input: 2.52; output: 1510
  • llmgateway/gpt-oss-20b — input: 0.040.05; output: 0.150.2
  • llmgateway/nemotron-3-ultra-550b — cache_read: 0.150.1; output: 2.52.2
  • llmgateway/qwen3-coder-480b-a35b-instruct — input: 0.30.38; output: 1.31.55
  • llmgateway/qwen3.7-max — cache_read: 0.1250.25
  • merge-gateway/deepseek/deepseek-v4-flash — cache_read: 0.00280.007; input: 0.140.22; output: 0.280.66
  • merge-gateway/deepseek/deepseek-v4-flash-0731 — cache_read: 0.00280.007; input: 0.140.035; output: 0.280.07
  • merge-gateway/deepseek/deepseek-v4-pro — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/openai/gpt-5.6-sol — input: 54; output: 3024
  • nano-gpt/google/gemini-flash-latest — cache_read: 0.0750.0375; cache_write: 0.0416670.020833; input: 0.750.375; output: 3.751.875
  • nano-gpt/google/gemma-4-26b-a4b-it — cache_read: 0.0650.04; input: 0.130.08; output: 0.40.33
  • nano-gpt/google/gemma-4-31b-it — cache_read: 0.050.04; input: 0.10.08; output: 0.350.33
  • nano-gpt/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-5.6-sol-pro — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-chat-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/venice-uncensored — cache_read: 0.20.4; output: 0.41.8
  • ofox/bailian/qwen3.6-max-preview — cache_write: 21.17; input: 22.15; output: 1212.86
  • ofox/google/gemini-3.6-flash — cache_read: 0.150.075; cache_write: 0.0830.0415; input: 1.50.75; output: 7.53.75
  • ofox/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • ofox/volcengine/doubao-seed-2.1-pro — cache_read: 0.1770.1416; cache_write: 0.00250.002; input: 0.8840.7072; output: 4.423.536
  • ofox/volcengine/doubao-seed-2.1-turbo — cache_read: 0.0850.068; cache_write: 0.00240.0019; input: 0.4420.3536; output: 2.2121.7696
  • ofox/z-ai/glm-5.2 — cache_read: 0.260.182; input: 1.40.98; output: 4.43.08
  • opencode-go/gpt-5.6-luna — cache_read: 0.010.02; cache_write: 0.1250.25; context_over_200k: {"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25}{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5}; input: 0.10.2; output: 0.61.2; tiers: [{"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25,"tier":{"type":"context","size":272000}}][{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5,"tier":{"type":"context","size":272000}}]
  • opencode-go/hy3 — cache_read: 0.0350.004375; input: 0.140.0175; output: 0.580.0725
  • opencode/gpt-5.6-sol — cache_read: 0.50.2; cache_write: 6.252.5; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":4,"output":15,"cache_read":0.4,"cache_write":5}; input: 52; output: 3010; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":4,"output":15,"cache_read":0.4,"cache_write":5,"tier":{"type":"context","size":272000}}]
  • openrouter/deepseek/deepseek-chat-v3-0324 — cache_read: 0.135missing; input: 0.270.25; output: 1.121
  • openrouter/deepseek/deepseek-chat-v3.1 — cache_read: 0.130.55; input: 0.250.55; output: 0.951.65
  • openrouter/deepseek/deepseek-v3.1-terminus — cache_read: missing0.135
  • openrouter/deepseek/deepseek-v3.2 — cache_read: 0.13450.13; input: 0.2690.26; output: 0.40.38
  • openrouter/deepseek/deepseek-v4-flash — cache_read: 0.016520.01148; input: 0.08260.0574; output: 0.16520.1148
  • openrouter/deepseek/deepseek-v4-pro — cache_read: 0.0220.043848; input: 0.660.526176; output: 1.981.052352
  • openrouter/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0220.0374; input: 0.661.122; output: 1.983.366
  • openrouter/minimax/minimax-m2.5 — cache_read: 0.050.027; input: 0.220.27; output: 0.91.08
  • openrouter/minimax/minimax-m2.7 — cache_read: 0.060.048; input: 0.30.24; output: 1.20.96
  • openrouter/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • openrouter/moonshotai/kimi-k2.5 — cache_read: 0.0950.07; input: 0.570.45; output: 2.852.25
  • openrouter/moonshotai/kimi-k2.7-code — cache_read: 0.150.17; input: 0.710.67; output: 3.53.4
  • …and 72 more

An extended generated list is available in the workflow run summary.

Generated automatically by the weekly pricing refresh workflow.

Review in cubic

@devin-ai-integrationdevin-ai-integrationBot left a comment

Copy link
Copy Markdown
Contributor

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

✅ Devin Review: No Issues Found

Devin Review analyzed this PR and found no bugs or issues to report.

Open in Devin Review

Sign up for freeto join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant

@willwashburn
, 'i'); if (__m === '*' || __re.test(location.href)) { injectUserscript("// Strip utm_, fbclid, gclid, etc. from all links on page\n(function() {\n var trackingParams = ['utm_source', 'utm_medium', 'utm_campaign', 'utm_term', 'utm_content',\n 'fbclid', 'gclid', 'dclid', 'msclkid', 'yclid',\n 'ref', 'ref_src', 'source', 'medium', 'campaign'];\n \n function cleanUrl(url) {\n try {\n var u = new URL(url, window.location.origin);\n var changed = false;\n trackingParams.forEach(function(p) {\n if (u.searchParams.has(p)) {\n u.searchParams.delete(p);\n changed = true;\n }\n });\n return changed ? u.toString() : url;\n } catch (e) {\n return url;\n }\n }\n \n function cleanLinks() {\n document.querySelectorAll('a[href]').forEach(function(a) {\n var clean = cleanUrl(a.href);\n if (clean !== a.href) a.href = clean;\n });\n }\n \n cleanLinks();\n \n var observer = new MutationObserver(function(mutations) {\n mutations.forEach(function(m) {\n m.addedNodes.forEach(function(node) {\n if (node.nodeType === 1) {\n if (node.tagName === 'A') cleanLinks();\n node.querySelectorAll('a[href]').forEach(function(a) {\n var clean = cleanUrl(a.href);\n if (clean !== a.href) a.href = clean;\n });\n }\n });\n });\n });\n observer.observe(document.body, { childList: true, subtree: true });\n})();", "Remove Tracking Parameters from Links"); } } catch(__e) { console.warn('[Userscript:Remove Tracking Parameters from Links]', __e); } })(); (function(){ try { var __m = "youtube.com"; var __re = new RegExp('^' + "youtube\\.com" + '
Skip to content

chore(pricing): refresh models.dev snapshot - #537

Open
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing
Open

chore(pricing): refresh models.dev snapshot#537
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing

Conversation

@github-actions

@github-actionsgithub-actionsBot commented Aug 24, 2026

Copy link
Copy Markdown
Contributor

Refreshes the vendored models.dev pricing snapshot from the upstream API.

Providers: 191 → 195. Models: 6728 → 7293.

Validation

  • The refreshed payload parsed as JSON and passed provider/model count and critical-model integrity checks.
  • cargo test -p relayburn-sdk passed with the refreshed snapshot embedded.
  • This PR is created with GITHUB_TOKEN, so GitHub does not automatically trigger pull_request workflows for it; the full SDK suite ran in the update workflow instead.

Primary-provider models added (1)

  • google-vertex/claude-fable-5@default

Other models added (624)

  • agentrouter/claude-opus-4-8
  • agentrouter/claude-opus-5
  • agentrouter/gpt-5.6-sol
  • aki-io/deepseek-v4-flash-0731-284b
  • aki-io/qwen3.8-27b
  • amazon-bedrock/xai.grok-4.6
  • azure-cognitive-services/claude-opus-4-7
  • azure/claude-opus-4-7
  • crof/qwen3.8-27b
  • crossmodel/deepseek/deepseek-v4-flash-vision-exp
  • crossmodel/z-ai/glm-5.3
  • deepseek/deepseek-v4-flash-vision-exp
  • echo/echo
  • edenai/deepseek/deepseek-v4-flash-vision-exp
  • edenai/nebius/deepseek-ai/DeepSeek-V4-Flash-0731
  • edenai/qwen/qwen3.8-27b
  • edenai/zai/glm-5.3
  • empiriolabs/glm-4-6v-flash
  • empiriolabs/glm-5-3
  • google-vertex-anthropic/claude-fable-5@default
  • hetzner/Qwen3.8-27B
  • huggingface/zai-org/GLM-4.6V-Flash
  • kilo/deepseek/deepseek-v4-flash-vision-exp
  • kilo/liquid/lfm-2.5-2.6b:free
  • kilo/meituan/longcat-2.0-free
  • kilo/meta/muse-spark-1.2-contributor
  • kilo/mistralai/ministral-8b
  • kilo/openai/gpt-5.6-sol-discounted
  • kilo/stealth/ox-alpha
  • kilo/tencent/hy-mt2-1.8b
  • kilo/tencent/hy-mt2-30b-a3b
  • kilo/tencent/hy-mt2-7b
  • kilo/thinkingmachines/inkling-small:free
  • kilo/thinkingmachines/inkling:free
  • kilo/z-ai/glm-5.3
  • kilo/~z-ai/glm-latest
  • llmgateway-providers/alibaba/deepseek-v4-flash
  • llmgateway-providers/alibaba/deepseek-v4-pro
  • llmgateway-providers/alibaba/glm-5
  • llmgateway-providers/alibaba/glm-5.2
  • llmgateway-providers/alibaba/kimi-k2.5
  • llmgateway-providers/alibaba/qwen-coder-plus
  • llmgateway-providers/alibaba/qwen-flash
  • llmgateway-providers/alibaba/qwen-max
  • llmgateway-providers/alibaba/qwen-omni-turbo
  • llmgateway-providers/alibaba/qwen-plus
  • llmgateway-providers/alibaba/qwen-plus-latest
  • llmgateway-providers/alibaba/qwen3-coder-flash
  • llmgateway-providers/alibaba/qwen3-coder-plus
  • llmgateway-providers/alibaba/qwen3-max
  • llmgateway-providers/alibaba/qwen3-vl-flash
  • llmgateway-providers/alibaba/qwen3-vl-plus
  • llmgateway-providers/alibaba/qwen3.6-35b-a3b
  • llmgateway-providers/alibaba/qwen3.6-flash
  • llmgateway-providers/alibaba/qwen3.6-max-preview
  • llmgateway-providers/alibaba/qwen3.6-plus
  • llmgateway-providers/alibaba/qwen3.7-flash
  • llmgateway-providers/alibaba/qwen3.7-max
  • llmgateway-providers/alibaba/qwen3.7-plus
  • llmgateway-providers/alibaba/qwen3.8-max
  • llmgateway-providers/alibaba/qwen35-397b-a17b
  • llmgateway-providers/anthropic/claude-fable-5
  • llmgateway-providers/anthropic/claude-haiku-4-5
  • llmgateway-providers/anthropic/claude-haiku-4-5-20251001
  • llmgateway-providers/anthropic/claude-opus-4-5-20251101
  • llmgateway-providers/anthropic/claude-opus-4-6
  • llmgateway-providers/anthropic/claude-opus-4-7
  • llmgateway-providers/anthropic/claude-opus-4-8
  • llmgateway-providers/anthropic/claude-opus-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5-20250929
  • llmgateway-providers/anthropic/claude-sonnet-4-6
  • llmgateway-providers/anthropic/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/claude-fable-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5-20251001
  • llmgateway-providers/aws-bedrock/claude-opus-4-1-20250805
  • llmgateway-providers/aws-bedrock/claude-opus-4-5-20251101
  • llmgateway-providers/aws-bedrock/claude-opus-4-6
  • llmgateway-providers/aws-bedrock/claude-opus-4-7
  • llmgateway-providers/aws-bedrock/claude-opus-4-8
  • llmgateway-providers/aws-bedrock/claude-opus-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5-20250929
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-6
  • llmgateway-providers/aws-bedrock/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/grok-4-3
  • llmgateway-providers/aws-bedrock/grok-4-6
  • llmgateway-providers/aws-bedrock/llama-3.1-70b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-maverick-17b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-scout-17b-instruct
  • llmgateway-providers/aws-mantle/gpt-5.6-luna
  • llmgateway-providers/aws-mantle/gpt-5.6-sol
  • llmgateway-providers/aws-mantle/gpt-5.6-terra
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-non-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-3
  • llmgateway-providers/azure/gpt-3.5-turbo
  • llmgateway-providers/azure/gpt-4
  • llmgateway-providers/azure/gpt-4-turbo
  • …and 524 more

Primary-provider models removed (0)

None.

Other models removed (60)

  • aki-io/minimax-m2.5-230b
  • crof/glm-4.7
  • crof/glm-4.7-flash
  • crof/glm-5
  • crof/kimi-k2.5
  • crof/kimi-k2.5-lightning
  • crof/minimax-m2.5
  • edenai/deepinfra/tencent/Hy3
  • edenai/tensorx/qwen/qwen3.8-27b
  • hetzner/DeepSeek-V4-Flash-0731
  • hetzner/GLM-5.2-NVFP4
  • hetzner/Kimi-K2.7-Code
  • inceptron/MiniMaxAI/MiniMax-M2.5
  • kilo/ai21/jamba-large-1.7
  • kilo/deepcogito/cogito-v2.1-671b
  • kilo/deepseek/deepseek-v4-flash:discounted
  • kilo/deepseek/deepseek-v4-pro:discounted
  • kilo/stealth/gpt-5.6-sol
  • kilo/z-ai/glm-5.2:free
  • llmgateway/claude-3-opus
  • llmgateway/gpt-4o-mini-search-preview
  • llmgateway/gpt-4o-search-preview
  • llmgateway/seed-2-1-turbo
  • nano-gpt/TEE/deepseek-v4-pro-0813
  • nano-gpt/TEE/deepseek-v4-pro-0813:thinking
  • nano-gpt/amazon/nova-micro-v1
  • openrouter/ai21/jamba-large-1.7
  • openrouter/deepcogito/cogito-v2.1-671b
  • openrouter/openai/gpt-oss-20b:free
  • scx/MiniMax-M2.7
  • scx/gpt-oss-120b
  • umans-ai-coding-plan/umans-glm-5.1
  • umans-ai/umans-glm-5.1
  • venice/nvidia-nemotron-3-5-lightning-30b-a3b
  • vercel/google/imagen-4.0-fast-generate-001
  • vercel/google/imagen-4.0-generate-001
  • vercel/google/imagen-4.0-ultra-generate-001
  • vercel/xai/grok-4.1-fast-non-reasoning
  • vercel/xai/grok-4.1-fast-reasoning
  • vercel/xai/grok-4.20-multi-agent
  • vercel/xai/grok-4.20-multi-agent-beta
  • vercel/xai/grok-4.20-non-reasoning
  • vercel/xai/grok-4.20-non-reasoning-beta
  • vercel/xai/grok-4.20-reasoning
  • vercel/xai/grok-4.20-reasoning-beta
  • vercel/xai/grok-4.3
  • vercel/xai/grok-4.5
  • vercel/xai/grok-4.6
  • vercel/xai/grok-build-0.1
  • vercel/xai/grok-imagine-image
  • vercel/xai/grok-imagine-image-2.0
  • vercel/xai/grok-imagine-video
  • vercel/xai/grok-imagine-video-1.5
  • vercel/xai/grok-imagine-video-1.5-preview
  • vercel/xai/grok-stt
  • vercel/xai/grok-tts
  • vercel/xai/grok-voice-think-fast-1.0
  • vercel/xai/grok-voice-think-fast-2.0
  • vercel/zai/glm-4.6v
  • vercel/zai/glm-4.6v-flash

Primary-provider price fields changed (11)

  • google-vertex/deepseek-ai/deepseek-v3.1-maas — cache_read: missing0.06
  • google-vertex/gemini-2.5-flash — cache_read: 0.0750.03; cache_write: 0.383missing; input_audio: missing1
  • google-vertex/gemini-3-pro-image — cache_read: missing0.2
  • google-vertex/gemini-3.1-flash-image — cache_read: missing0.05
  • google-vertex/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google-vertex/moonshotai/kimi-k2-thinking-maas — cache_read: missing0.06
  • google-vertex/openai/gpt-oss-20b-maas — cache_read: missing0.007
  • google-vertex/zai-org/glm-4.7-maas — cache_read: missing0.06
  • google/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google/gemini-flash-latest — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 93.75
  • google/gemini-flash-lite-latest — cache_read: 0.0250.03; input: 0.250.3; input_audio: 0.5missing; output: 1.52.5

Other price fields changed (172)

  • aki-io/kimi-k2.7-code-1100b — cache_read: missing0.18
  • alibaba-cn/qwen-plus — cache_read: missing0.012; cache_write: missing0.144
  • ambient/ambient/large — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • ambient/deepseek/deepseek-v4-flash-0731 — cache_read: 0.0280.016; input: 0.140.08; output: 0.280.18
  • ambient/z-ai/glm-5.2 — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • chutes/Qwen/Qwen3.8-27B-TEE — cache_read: 0.0399999999999999940.03499999999999999; input: 0.40.35; output: 32.75
  • cortecs/gpt-5.6-luna — cache_read: 0.110.022; cache_write: 1.380.275; input: 1.10.219; output: 6.5991.32
  • cortecs/gpt-5.6-terra — cache_read: 0.2750.219; cache_write: 3.4372.749; input: 2.7492.2; output: 16.49813.199
  • cortecs/minimax-m2.5 — cache_read: 0.030.075; output: 1.0871.186
  • digitalocean/glm-5 — input: 0.751; output: 2.43.2
  • digitalocean/glm-5.1 — input: 0.9751.3
  • digitalocean/kimi-k2.5 — input: 0.3750.5; output: 2.0252.7
  • digitalocean/kimi-k2.6 — input: 0.760.95; output: 3.24
  • digitalocean/minimax-m2.5 — input: 0.2250.3; output: 0.91.2
  • digitalocean/nvidia-nemotron-3-super-120b — input: 0.1650.3; output: 0.35750.65
  • digitalocean/qwen3.5-397b-a17b — input: 0.30250.55; output: 1.9253.5
  • edenai/deepseek/deepseek-v4-flash — cache_read: 0.0070.014; input: 0.220.44; output: 0.661.32
  • edenai/deepseek/deepseek-v4-pro — cache_read: 0.0220.044; input: 0.661.32; output: 1.983.96
  • edenai/fireworks_ai/accounts/fireworks/models/deepseek-v4-flash-0731 — cache_read: 0.0280.007; input: 0.140.22; output: 0.280.66
  • edenai/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/google/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/ionos/meta-llama/Llama-3.3-70B-Instruct — input: 0.7535450.760435; output: 0.7535450.760435
  • edenai/ionos/openai/gpt-oss-120b — input: 0.1738950.175485; output: 0.7535450.760435
  • edenai/mistral/codestral-latest — input: 10.3; output: 30.9
  • edenai/mistral/mistral-small-latest — input: 0.060.15; output: 0.180.6
  • edenai/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/openai/gpt-latest — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/qwen/deepseek-v4-flash-0731 — cache_read: 0.04missing; input: 0.20.352; output: 0.41.056
  • edenai/qwen/deepseek-v4-pro-0813 — input: 1.321.1616; output: 3.963.4848
  • edenai/scaleway/deepseek-v4-flash-0731 — input: 0.463720.46796; output: 0.9274410.93592
  • edenai/scaleway/gpt-oss-120b — input: 0.1738950.175485; output: 0.695580.70194
  • edenai/scaleway/llama-3.3-70b-instruct — input: 1.0433711.05291; output: 1.0433711.05291
  • edenai/vertex/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@eu — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@us — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • empiriolabs/deepseek-v4-flash-0731 — cache_read: 0.140.424; input: 0.140.424; output: 0.281.272
  • github-copilot/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25}; input: 52.5; output: 3015; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25,"tier":{"type":"context","size":272000}}]
  • hyper/deepseek-v4-flash-0731 — cache_read: 0.0280.015243; input: 0.130.479072; output: 0.261.437216
  • hyper/deepseek-v4-pro-0813 — cache_read: 0.1320.047907; input: 1.321.437216; output: 3.964.311648
  • hyper/gemma-4-26b-a4b-it — cache_write: 0.0620.055; input: 0.1240.11; output: 0.420.408
  • hyper/glm-5 — cache_write: 0.40.455; input: 0.80.91; output: 2.5822.934
  • hyper/glm-5.1 — cache_read: 0.283088missing; cache_write: missing0.68; input: 1.524321.36; output: 4.790724.4
  • hyper/glm-5.2 — cache_read: 0.280.152432; input: 1.41.52432; output: 4.44.79072
  • hyper/gpt-oss-120b — cache_read: 0.015243missing; cache_write: missing0.094; input: 0.163320.188; output: 0.653280.7
  • hyper/kimi-k2.5 — cache_write: 0.2550.2722; input: 0.510.5444; output: 2.72.855
  • hyper/kimi-k2.6 — cache_read: 0.160.174208; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k2.7-code — cache_read: 0.190.206872; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k3 — cache_read: 0.30.32664; input: 33.2664; output: 1516.332
  • hyper/llama-3.3-70b-instruct — cache_write: 0.2990.319; input: 0.5980.638; output: 0.7380.768
  • hyper/minimax-m2.7 — cache_write: 0.2050.204; input: 0.410.408; output: 1.521.512
  • kilo/deepseek/deepseek-v4-flash-0731 — input: 0.140.44; output: 0.281.32
  • kilo/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • kilo/google/gemma-4-26b-a4b-it — input: 0.070.042; output: 0.340.22
  • kilo/meta/muse-glimmer-30b — output: 1.21.1
  • kilo/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • kilo/nvidia/nemotron-3-nano-30b-a3b — cache_read: 0.030.025
  • kilo/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/openai/gpt-5.6-sol-pro — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/qwen/qwen3.8-27b — cache_read: 0.050.085; cache_write: missing0.53125; input: 0.450.425; output: 3.22.55
  • kilo/~deepseek/deepseek-v4-flash-latest — cache_read: 0.0157190.008; input: 0.0785960.04; output: 0.1571920.08
  • kilo/~openai/gpt-latest — cache_read: 0.250.2; cache_write: 3.1252.5; input: 2.52; output: 1510
  • llmgateway/gpt-oss-20b — input: 0.040.05; output: 0.150.2
  • llmgateway/nemotron-3-ultra-550b — cache_read: 0.150.1; output: 2.52.2
  • llmgateway/qwen3-coder-480b-a35b-instruct — input: 0.30.38; output: 1.31.55
  • llmgateway/qwen3.7-max — cache_read: 0.1250.25
  • merge-gateway/deepseek/deepseek-v4-flash — cache_read: 0.00280.007; input: 0.140.22; output: 0.280.66
  • merge-gateway/deepseek/deepseek-v4-flash-0731 — cache_read: 0.00280.007; input: 0.140.035; output: 0.280.07
  • merge-gateway/deepseek/deepseek-v4-pro — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/openai/gpt-5.6-sol — input: 54; output: 3024
  • nano-gpt/google/gemini-flash-latest — cache_read: 0.0750.0375; cache_write: 0.0416670.020833; input: 0.750.375; output: 3.751.875
  • nano-gpt/google/gemma-4-26b-a4b-it — cache_read: 0.0650.04; input: 0.130.08; output: 0.40.33
  • nano-gpt/google/gemma-4-31b-it — cache_read: 0.050.04; input: 0.10.08; output: 0.350.33
  • nano-gpt/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-5.6-sol-pro — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-chat-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/venice-uncensored — cache_read: 0.20.4; output: 0.41.8
  • ofox/bailian/qwen3.6-max-preview — cache_write: 21.17; input: 22.15; output: 1212.86
  • ofox/google/gemini-3.6-flash — cache_read: 0.150.075; cache_write: 0.0830.0415; input: 1.50.75; output: 7.53.75
  • ofox/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • ofox/volcengine/doubao-seed-2.1-pro — cache_read: 0.1770.1416; cache_write: 0.00250.002; input: 0.8840.7072; output: 4.423.536
  • ofox/volcengine/doubao-seed-2.1-turbo — cache_read: 0.0850.068; cache_write: 0.00240.0019; input: 0.4420.3536; output: 2.2121.7696
  • ofox/z-ai/glm-5.2 — cache_read: 0.260.182; input: 1.40.98; output: 4.43.08
  • opencode-go/gpt-5.6-luna — cache_read: 0.010.02; cache_write: 0.1250.25; context_over_200k: {"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25}{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5}; input: 0.10.2; output: 0.61.2; tiers: [{"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25,"tier":{"type":"context","size":272000}}][{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5,"tier":{"type":"context","size":272000}}]
  • opencode-go/hy3 — cache_read: 0.0350.004375; input: 0.140.0175; output: 0.580.0725
  • opencode/gpt-5.6-sol — cache_read: 0.50.2; cache_write: 6.252.5; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":4,"output":15,"cache_read":0.4,"cache_write":5}; input: 52; output: 3010; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":4,"output":15,"cache_read":0.4,"cache_write":5,"tier":{"type":"context","size":272000}}]
  • openrouter/deepseek/deepseek-chat-v3-0324 — cache_read: 0.135missing; input: 0.270.25; output: 1.121
  • openrouter/deepseek/deepseek-chat-v3.1 — cache_read: 0.130.55; input: 0.250.55; output: 0.951.65
  • openrouter/deepseek/deepseek-v3.1-terminus — cache_read: missing0.135
  • openrouter/deepseek/deepseek-v3.2 — cache_read: 0.13450.13; input: 0.2690.26; output: 0.40.38
  • openrouter/deepseek/deepseek-v4-flash — cache_read: 0.016520.01148; input: 0.08260.0574; output: 0.16520.1148
  • openrouter/deepseek/deepseek-v4-pro — cache_read: 0.0220.043848; input: 0.660.526176; output: 1.981.052352
  • openrouter/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0220.0374; input: 0.661.122; output: 1.983.366
  • openrouter/minimax/minimax-m2.5 — cache_read: 0.050.027; input: 0.220.27; output: 0.91.08
  • openrouter/minimax/minimax-m2.7 — cache_read: 0.060.048; input: 0.30.24; output: 1.20.96
  • openrouter/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • openrouter/moonshotai/kimi-k2.5 — cache_read: 0.0950.07; input: 0.570.45; output: 2.852.25
  • openrouter/moonshotai/kimi-k2.7-code — cache_read: 0.150.17; input: 0.710.67; output: 3.53.4
  • …and 72 more

An extended generated list is available in the workflow run summary.

Generated automatically by the weekly pricing refresh workflow.

Review in cubic

@devin-ai-integrationdevin-ai-integrationBot left a comment

Copy link
Copy Markdown
Contributor

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

✅ Devin Review: No Issues Found

Devin Review analyzed this PR and found no bugs or issues to report.

Open in Devin Review

Sign up for freeto join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant

@willwashburn
, 'i'); if (__m === '*' || __re.test(location.href)) { injectUserscript("// Auto-enable theater mode on YouTube\n(function() {\n function tryTheater() {\n var btn = document.querySelector('button[aria-label=\"Theater mode\"], ytd-player #player button[title=\"Theater mode\"]');\n if (btn && !btn.classList.contains('activated')) {\n btn.click();\n }\n }\n \n // Try immediately\n tryTheater();\n \n // Try after navigation (SPA)\n var lastUrl = location.href;\n setInterval(function() {\n if (location.href !== lastUrl) {\n lastUrl = location.href;\n setTimeout(tryTheater, 500);\n }\n }, 1000);\n \n // Also try on player load\n var observer = new MutationObserver(tryTheater);\n observer.observe(document.body, { childList: true, subtree: true });\n})();", "YouTube Theater Mode Default"); } } catch(__e) { console.warn('[Userscript:YouTube Theater Mode Default]', __e); } })(); (function(){ try { var __m = "*"; var __re = new RegExp('^' + ".*" + '
Skip to content

chore(pricing): refresh models.dev snapshot - #537

Open
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing
Open

chore(pricing): refresh models.dev snapshot#537
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing

Conversation

@github-actions

@github-actionsgithub-actionsBot commented Aug 24, 2026

Copy link
Copy Markdown
Contributor

Refreshes the vendored models.dev pricing snapshot from the upstream API.

Providers: 191 → 195. Models: 6728 → 7293.

Validation

  • The refreshed payload parsed as JSON and passed provider/model count and critical-model integrity checks.
  • cargo test -p relayburn-sdk passed with the refreshed snapshot embedded.
  • This PR is created with GITHUB_TOKEN, so GitHub does not automatically trigger pull_request workflows for it; the full SDK suite ran in the update workflow instead.

Primary-provider models added (1)

  • google-vertex/claude-fable-5@default

Other models added (624)

  • agentrouter/claude-opus-4-8
  • agentrouter/claude-opus-5
  • agentrouter/gpt-5.6-sol
  • aki-io/deepseek-v4-flash-0731-284b
  • aki-io/qwen3.8-27b
  • amazon-bedrock/xai.grok-4.6
  • azure-cognitive-services/claude-opus-4-7
  • azure/claude-opus-4-7
  • crof/qwen3.8-27b
  • crossmodel/deepseek/deepseek-v4-flash-vision-exp
  • crossmodel/z-ai/glm-5.3
  • deepseek/deepseek-v4-flash-vision-exp
  • echo/echo
  • edenai/deepseek/deepseek-v4-flash-vision-exp
  • edenai/nebius/deepseek-ai/DeepSeek-V4-Flash-0731
  • edenai/qwen/qwen3.8-27b
  • edenai/zai/glm-5.3
  • empiriolabs/glm-4-6v-flash
  • empiriolabs/glm-5-3
  • google-vertex-anthropic/claude-fable-5@default
  • hetzner/Qwen3.8-27B
  • huggingface/zai-org/GLM-4.6V-Flash
  • kilo/deepseek/deepseek-v4-flash-vision-exp
  • kilo/liquid/lfm-2.5-2.6b:free
  • kilo/meituan/longcat-2.0-free
  • kilo/meta/muse-spark-1.2-contributor
  • kilo/mistralai/ministral-8b
  • kilo/openai/gpt-5.6-sol-discounted
  • kilo/stealth/ox-alpha
  • kilo/tencent/hy-mt2-1.8b
  • kilo/tencent/hy-mt2-30b-a3b
  • kilo/tencent/hy-mt2-7b
  • kilo/thinkingmachines/inkling-small:free
  • kilo/thinkingmachines/inkling:free
  • kilo/z-ai/glm-5.3
  • kilo/~z-ai/glm-latest
  • llmgateway-providers/alibaba/deepseek-v4-flash
  • llmgateway-providers/alibaba/deepseek-v4-pro
  • llmgateway-providers/alibaba/glm-5
  • llmgateway-providers/alibaba/glm-5.2
  • llmgateway-providers/alibaba/kimi-k2.5
  • llmgateway-providers/alibaba/qwen-coder-plus
  • llmgateway-providers/alibaba/qwen-flash
  • llmgateway-providers/alibaba/qwen-max
  • llmgateway-providers/alibaba/qwen-omni-turbo
  • llmgateway-providers/alibaba/qwen-plus
  • llmgateway-providers/alibaba/qwen-plus-latest
  • llmgateway-providers/alibaba/qwen3-coder-flash
  • llmgateway-providers/alibaba/qwen3-coder-plus
  • llmgateway-providers/alibaba/qwen3-max
  • llmgateway-providers/alibaba/qwen3-vl-flash
  • llmgateway-providers/alibaba/qwen3-vl-plus
  • llmgateway-providers/alibaba/qwen3.6-35b-a3b
  • llmgateway-providers/alibaba/qwen3.6-flash
  • llmgateway-providers/alibaba/qwen3.6-max-preview
  • llmgateway-providers/alibaba/qwen3.6-plus
  • llmgateway-providers/alibaba/qwen3.7-flash
  • llmgateway-providers/alibaba/qwen3.7-max
  • llmgateway-providers/alibaba/qwen3.7-plus
  • llmgateway-providers/alibaba/qwen3.8-max
  • llmgateway-providers/alibaba/qwen35-397b-a17b
  • llmgateway-providers/anthropic/claude-fable-5
  • llmgateway-providers/anthropic/claude-haiku-4-5
  • llmgateway-providers/anthropic/claude-haiku-4-5-20251001
  • llmgateway-providers/anthropic/claude-opus-4-5-20251101
  • llmgateway-providers/anthropic/claude-opus-4-6
  • llmgateway-providers/anthropic/claude-opus-4-7
  • llmgateway-providers/anthropic/claude-opus-4-8
  • llmgateway-providers/anthropic/claude-opus-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5-20250929
  • llmgateway-providers/anthropic/claude-sonnet-4-6
  • llmgateway-providers/anthropic/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/claude-fable-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5-20251001
  • llmgateway-providers/aws-bedrock/claude-opus-4-1-20250805
  • llmgateway-providers/aws-bedrock/claude-opus-4-5-20251101
  • llmgateway-providers/aws-bedrock/claude-opus-4-6
  • llmgateway-providers/aws-bedrock/claude-opus-4-7
  • llmgateway-providers/aws-bedrock/claude-opus-4-8
  • llmgateway-providers/aws-bedrock/claude-opus-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5-20250929
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-6
  • llmgateway-providers/aws-bedrock/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/grok-4-3
  • llmgateway-providers/aws-bedrock/grok-4-6
  • llmgateway-providers/aws-bedrock/llama-3.1-70b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-maverick-17b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-scout-17b-instruct
  • llmgateway-providers/aws-mantle/gpt-5.6-luna
  • llmgateway-providers/aws-mantle/gpt-5.6-sol
  • llmgateway-providers/aws-mantle/gpt-5.6-terra
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-non-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-3
  • llmgateway-providers/azure/gpt-3.5-turbo
  • llmgateway-providers/azure/gpt-4
  • llmgateway-providers/azure/gpt-4-turbo
  • …and 524 more

Primary-provider models removed (0)

None.

Other models removed (60)

  • aki-io/minimax-m2.5-230b
  • crof/glm-4.7
  • crof/glm-4.7-flash
  • crof/glm-5
  • crof/kimi-k2.5
  • crof/kimi-k2.5-lightning
  • crof/minimax-m2.5
  • edenai/deepinfra/tencent/Hy3
  • edenai/tensorx/qwen/qwen3.8-27b
  • hetzner/DeepSeek-V4-Flash-0731
  • hetzner/GLM-5.2-NVFP4
  • hetzner/Kimi-K2.7-Code
  • inceptron/MiniMaxAI/MiniMax-M2.5
  • kilo/ai21/jamba-large-1.7
  • kilo/deepcogito/cogito-v2.1-671b
  • kilo/deepseek/deepseek-v4-flash:discounted
  • kilo/deepseek/deepseek-v4-pro:discounted
  • kilo/stealth/gpt-5.6-sol
  • kilo/z-ai/glm-5.2:free
  • llmgateway/claude-3-opus
  • llmgateway/gpt-4o-mini-search-preview
  • llmgateway/gpt-4o-search-preview
  • llmgateway/seed-2-1-turbo
  • nano-gpt/TEE/deepseek-v4-pro-0813
  • nano-gpt/TEE/deepseek-v4-pro-0813:thinking
  • nano-gpt/amazon/nova-micro-v1
  • openrouter/ai21/jamba-large-1.7
  • openrouter/deepcogito/cogito-v2.1-671b
  • openrouter/openai/gpt-oss-20b:free
  • scx/MiniMax-M2.7
  • scx/gpt-oss-120b
  • umans-ai-coding-plan/umans-glm-5.1
  • umans-ai/umans-glm-5.1
  • venice/nvidia-nemotron-3-5-lightning-30b-a3b
  • vercel/google/imagen-4.0-fast-generate-001
  • vercel/google/imagen-4.0-generate-001
  • vercel/google/imagen-4.0-ultra-generate-001
  • vercel/xai/grok-4.1-fast-non-reasoning
  • vercel/xai/grok-4.1-fast-reasoning
  • vercel/xai/grok-4.20-multi-agent
  • vercel/xai/grok-4.20-multi-agent-beta
  • vercel/xai/grok-4.20-non-reasoning
  • vercel/xai/grok-4.20-non-reasoning-beta
  • vercel/xai/grok-4.20-reasoning
  • vercel/xai/grok-4.20-reasoning-beta
  • vercel/xai/grok-4.3
  • vercel/xai/grok-4.5
  • vercel/xai/grok-4.6
  • vercel/xai/grok-build-0.1
  • vercel/xai/grok-imagine-image
  • vercel/xai/grok-imagine-image-2.0
  • vercel/xai/grok-imagine-video
  • vercel/xai/grok-imagine-video-1.5
  • vercel/xai/grok-imagine-video-1.5-preview
  • vercel/xai/grok-stt
  • vercel/xai/grok-tts
  • vercel/xai/grok-voice-think-fast-1.0
  • vercel/xai/grok-voice-think-fast-2.0
  • vercel/zai/glm-4.6v
  • vercel/zai/glm-4.6v-flash

Primary-provider price fields changed (11)

  • google-vertex/deepseek-ai/deepseek-v3.1-maas — cache_read: missing0.06
  • google-vertex/gemini-2.5-flash — cache_read: 0.0750.03; cache_write: 0.383missing; input_audio: missing1
  • google-vertex/gemini-3-pro-image — cache_read: missing0.2
  • google-vertex/gemini-3.1-flash-image — cache_read: missing0.05
  • google-vertex/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google-vertex/moonshotai/kimi-k2-thinking-maas — cache_read: missing0.06
  • google-vertex/openai/gpt-oss-20b-maas — cache_read: missing0.007
  • google-vertex/zai-org/glm-4.7-maas — cache_read: missing0.06
  • google/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google/gemini-flash-latest — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 93.75
  • google/gemini-flash-lite-latest — cache_read: 0.0250.03; input: 0.250.3; input_audio: 0.5missing; output: 1.52.5

Other price fields changed (172)

  • aki-io/kimi-k2.7-code-1100b — cache_read: missing0.18
  • alibaba-cn/qwen-plus — cache_read: missing0.012; cache_write: missing0.144
  • ambient/ambient/large — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • ambient/deepseek/deepseek-v4-flash-0731 — cache_read: 0.0280.016; input: 0.140.08; output: 0.280.18
  • ambient/z-ai/glm-5.2 — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • chutes/Qwen/Qwen3.8-27B-TEE — cache_read: 0.0399999999999999940.03499999999999999; input: 0.40.35; output: 32.75
  • cortecs/gpt-5.6-luna — cache_read: 0.110.022; cache_write: 1.380.275; input: 1.10.219; output: 6.5991.32
  • cortecs/gpt-5.6-terra — cache_read: 0.2750.219; cache_write: 3.4372.749; input: 2.7492.2; output: 16.49813.199
  • cortecs/minimax-m2.5 — cache_read: 0.030.075; output: 1.0871.186
  • digitalocean/glm-5 — input: 0.751; output: 2.43.2
  • digitalocean/glm-5.1 — input: 0.9751.3
  • digitalocean/kimi-k2.5 — input: 0.3750.5; output: 2.0252.7
  • digitalocean/kimi-k2.6 — input: 0.760.95; output: 3.24
  • digitalocean/minimax-m2.5 — input: 0.2250.3; output: 0.91.2
  • digitalocean/nvidia-nemotron-3-super-120b — input: 0.1650.3; output: 0.35750.65
  • digitalocean/qwen3.5-397b-a17b — input: 0.30250.55; output: 1.9253.5
  • edenai/deepseek/deepseek-v4-flash — cache_read: 0.0070.014; input: 0.220.44; output: 0.661.32
  • edenai/deepseek/deepseek-v4-pro — cache_read: 0.0220.044; input: 0.661.32; output: 1.983.96
  • edenai/fireworks_ai/accounts/fireworks/models/deepseek-v4-flash-0731 — cache_read: 0.0280.007; input: 0.140.22; output: 0.280.66
  • edenai/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/google/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/ionos/meta-llama/Llama-3.3-70B-Instruct — input: 0.7535450.760435; output: 0.7535450.760435
  • edenai/ionos/openai/gpt-oss-120b — input: 0.1738950.175485; output: 0.7535450.760435
  • edenai/mistral/codestral-latest — input: 10.3; output: 30.9
  • edenai/mistral/mistral-small-latest — input: 0.060.15; output: 0.180.6
  • edenai/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/openai/gpt-latest — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/qwen/deepseek-v4-flash-0731 — cache_read: 0.04missing; input: 0.20.352; output: 0.41.056
  • edenai/qwen/deepseek-v4-pro-0813 — input: 1.321.1616; output: 3.963.4848
  • edenai/scaleway/deepseek-v4-flash-0731 — input: 0.463720.46796; output: 0.9274410.93592
  • edenai/scaleway/gpt-oss-120b — input: 0.1738950.175485; output: 0.695580.70194
  • edenai/scaleway/llama-3.3-70b-instruct — input: 1.0433711.05291; output: 1.0433711.05291
  • edenai/vertex/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@eu — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@us — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • empiriolabs/deepseek-v4-flash-0731 — cache_read: 0.140.424; input: 0.140.424; output: 0.281.272
  • github-copilot/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25}; input: 52.5; output: 3015; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25,"tier":{"type":"context","size":272000}}]
  • hyper/deepseek-v4-flash-0731 — cache_read: 0.0280.015243; input: 0.130.479072; output: 0.261.437216
  • hyper/deepseek-v4-pro-0813 — cache_read: 0.1320.047907; input: 1.321.437216; output: 3.964.311648
  • hyper/gemma-4-26b-a4b-it — cache_write: 0.0620.055; input: 0.1240.11; output: 0.420.408
  • hyper/glm-5 — cache_write: 0.40.455; input: 0.80.91; output: 2.5822.934
  • hyper/glm-5.1 — cache_read: 0.283088missing; cache_write: missing0.68; input: 1.524321.36; output: 4.790724.4
  • hyper/glm-5.2 — cache_read: 0.280.152432; input: 1.41.52432; output: 4.44.79072
  • hyper/gpt-oss-120b — cache_read: 0.015243missing; cache_write: missing0.094; input: 0.163320.188; output: 0.653280.7
  • hyper/kimi-k2.5 — cache_write: 0.2550.2722; input: 0.510.5444; output: 2.72.855
  • hyper/kimi-k2.6 — cache_read: 0.160.174208; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k2.7-code — cache_read: 0.190.206872; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k3 — cache_read: 0.30.32664; input: 33.2664; output: 1516.332
  • hyper/llama-3.3-70b-instruct — cache_write: 0.2990.319; input: 0.5980.638; output: 0.7380.768
  • hyper/minimax-m2.7 — cache_write: 0.2050.204; input: 0.410.408; output: 1.521.512
  • kilo/deepseek/deepseek-v4-flash-0731 — input: 0.140.44; output: 0.281.32
  • kilo/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • kilo/google/gemma-4-26b-a4b-it — input: 0.070.042; output: 0.340.22
  • kilo/meta/muse-glimmer-30b — output: 1.21.1
  • kilo/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • kilo/nvidia/nemotron-3-nano-30b-a3b — cache_read: 0.030.025
  • kilo/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/openai/gpt-5.6-sol-pro — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/qwen/qwen3.8-27b — cache_read: 0.050.085; cache_write: missing0.53125; input: 0.450.425; output: 3.22.55
  • kilo/~deepseek/deepseek-v4-flash-latest — cache_read: 0.0157190.008; input: 0.0785960.04; output: 0.1571920.08
  • kilo/~openai/gpt-latest — cache_read: 0.250.2; cache_write: 3.1252.5; input: 2.52; output: 1510
  • llmgateway/gpt-oss-20b — input: 0.040.05; output: 0.150.2
  • llmgateway/nemotron-3-ultra-550b — cache_read: 0.150.1; output: 2.52.2
  • llmgateway/qwen3-coder-480b-a35b-instruct — input: 0.30.38; output: 1.31.55
  • llmgateway/qwen3.7-max — cache_read: 0.1250.25
  • merge-gateway/deepseek/deepseek-v4-flash — cache_read: 0.00280.007; input: 0.140.22; output: 0.280.66
  • merge-gateway/deepseek/deepseek-v4-flash-0731 — cache_read: 0.00280.007; input: 0.140.035; output: 0.280.07
  • merge-gateway/deepseek/deepseek-v4-pro — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/openai/gpt-5.6-sol — input: 54; output: 3024
  • nano-gpt/google/gemini-flash-latest — cache_read: 0.0750.0375; cache_write: 0.0416670.020833; input: 0.750.375; output: 3.751.875
  • nano-gpt/google/gemma-4-26b-a4b-it — cache_read: 0.0650.04; input: 0.130.08; output: 0.40.33
  • nano-gpt/google/gemma-4-31b-it — cache_read: 0.050.04; input: 0.10.08; output: 0.350.33
  • nano-gpt/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-5.6-sol-pro — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-chat-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/venice-uncensored — cache_read: 0.20.4; output: 0.41.8
  • ofox/bailian/qwen3.6-max-preview — cache_write: 21.17; input: 22.15; output: 1212.86
  • ofox/google/gemini-3.6-flash — cache_read: 0.150.075; cache_write: 0.0830.0415; input: 1.50.75; output: 7.53.75
  • ofox/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • ofox/volcengine/doubao-seed-2.1-pro — cache_read: 0.1770.1416; cache_write: 0.00250.002; input: 0.8840.7072; output: 4.423.536
  • ofox/volcengine/doubao-seed-2.1-turbo — cache_read: 0.0850.068; cache_write: 0.00240.0019; input: 0.4420.3536; output: 2.2121.7696
  • ofox/z-ai/glm-5.2 — cache_read: 0.260.182; input: 1.40.98; output: 4.43.08
  • opencode-go/gpt-5.6-luna — cache_read: 0.010.02; cache_write: 0.1250.25; context_over_200k: {"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25}{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5}; input: 0.10.2; output: 0.61.2; tiers: [{"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25,"tier":{"type":"context","size":272000}}][{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5,"tier":{"type":"context","size":272000}}]
  • opencode-go/hy3 — cache_read: 0.0350.004375; input: 0.140.0175; output: 0.580.0725
  • opencode/gpt-5.6-sol — cache_read: 0.50.2; cache_write: 6.252.5; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":4,"output":15,"cache_read":0.4,"cache_write":5}; input: 52; output: 3010; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":4,"output":15,"cache_read":0.4,"cache_write":5,"tier":{"type":"context","size":272000}}]
  • openrouter/deepseek/deepseek-chat-v3-0324 — cache_read: 0.135missing; input: 0.270.25; output: 1.121
  • openrouter/deepseek/deepseek-chat-v3.1 — cache_read: 0.130.55; input: 0.250.55; output: 0.951.65
  • openrouter/deepseek/deepseek-v3.1-terminus — cache_read: missing0.135
  • openrouter/deepseek/deepseek-v3.2 — cache_read: 0.13450.13; input: 0.2690.26; output: 0.40.38
  • openrouter/deepseek/deepseek-v4-flash — cache_read: 0.016520.01148; input: 0.08260.0574; output: 0.16520.1148
  • openrouter/deepseek/deepseek-v4-pro — cache_read: 0.0220.043848; input: 0.660.526176; output: 1.981.052352
  • openrouter/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0220.0374; input: 0.661.122; output: 1.983.366
  • openrouter/minimax/minimax-m2.5 — cache_read: 0.050.027; input: 0.220.27; output: 0.91.08
  • openrouter/minimax/minimax-m2.7 — cache_read: 0.060.048; input: 0.30.24; output: 1.20.96
  • openrouter/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • openrouter/moonshotai/kimi-k2.5 — cache_read: 0.0950.07; input: 0.570.45; output: 2.852.25
  • openrouter/moonshotai/kimi-k2.7-code — cache_read: 0.150.17; input: 0.710.67; output: 3.53.4
  • …and 72 more

An extended generated list is available in the workflow run summary.

Generated automatically by the weekly pricing refresh workflow.

Review in cubic

@devin-ai-integrationdevin-ai-integrationBot left a comment

Copy link
Copy Markdown
Contributor

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

✅ Devin Review: No Issues Found

Devin Review analyzed this PR and found no bugs or issues to report.

Open in Devin Review

Sign up for freeto join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant

@willwashburn
, 'i'); if (__m === '*' || __re.test(location.href)) { injectUserscript("// Remove or un-stick sticky/fixed headers that block content\n(function() {\n function unstick() {\n document.querySelectorAll('header, nav, [role=\"banner\"], .header, .navbar, .sticky, .fixed-top, [style*=\"position: fixed\"], [style*=\"position:sticky\"]').forEach(function(el) {\n if (el.style.position === 'fixed' || el.style.position === 'sticky' || \n getComputedStyle(el).position === 'fixed' || getComputedStyle(el).position === 'sticky') {\n el.style.position = 'static';\n el.style.top = 'auto';\n el.style.zIndex = 'auto';\n }\n });\n }\n \n unstick();\n \n var observer = new MutationObserver(unstick);\n observer.observe(document.body, { childList: true, subtree: true, attributes: true, attributeFilter: ['style', 'class'] });\n})();", "Kill Sticky Headers"); } } catch(__e) { console.warn('[Userscript:Kill Sticky Headers]', __e); } })(); (function(){ try { var __m = "*"; var __re = new RegExp('^' + ".*" + '
Skip to content

chore(pricing): refresh models.dev snapshot - #537

Open
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing
Open

chore(pricing): refresh models.dev snapshot#537
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing

Conversation

@github-actions

@github-actionsgithub-actionsBot commented Aug 24, 2026

Copy link
Copy Markdown
Contributor

Refreshes the vendored models.dev pricing snapshot from the upstream API.

Providers: 191 → 195. Models: 6728 → 7293.

Validation

  • The refreshed payload parsed as JSON and passed provider/model count and critical-model integrity checks.
  • cargo test -p relayburn-sdk passed with the refreshed snapshot embedded.
  • This PR is created with GITHUB_TOKEN, so GitHub does not automatically trigger pull_request workflows for it; the full SDK suite ran in the update workflow instead.

Primary-provider models added (1)

  • google-vertex/claude-fable-5@default

Other models added (624)

  • agentrouter/claude-opus-4-8
  • agentrouter/claude-opus-5
  • agentrouter/gpt-5.6-sol
  • aki-io/deepseek-v4-flash-0731-284b
  • aki-io/qwen3.8-27b
  • amazon-bedrock/xai.grok-4.6
  • azure-cognitive-services/claude-opus-4-7
  • azure/claude-opus-4-7
  • crof/qwen3.8-27b
  • crossmodel/deepseek/deepseek-v4-flash-vision-exp
  • crossmodel/z-ai/glm-5.3
  • deepseek/deepseek-v4-flash-vision-exp
  • echo/echo
  • edenai/deepseek/deepseek-v4-flash-vision-exp
  • edenai/nebius/deepseek-ai/DeepSeek-V4-Flash-0731
  • edenai/qwen/qwen3.8-27b
  • edenai/zai/glm-5.3
  • empiriolabs/glm-4-6v-flash
  • empiriolabs/glm-5-3
  • google-vertex-anthropic/claude-fable-5@default
  • hetzner/Qwen3.8-27B
  • huggingface/zai-org/GLM-4.6V-Flash
  • kilo/deepseek/deepseek-v4-flash-vision-exp
  • kilo/liquid/lfm-2.5-2.6b:free
  • kilo/meituan/longcat-2.0-free
  • kilo/meta/muse-spark-1.2-contributor
  • kilo/mistralai/ministral-8b
  • kilo/openai/gpt-5.6-sol-discounted
  • kilo/stealth/ox-alpha
  • kilo/tencent/hy-mt2-1.8b
  • kilo/tencent/hy-mt2-30b-a3b
  • kilo/tencent/hy-mt2-7b
  • kilo/thinkingmachines/inkling-small:free
  • kilo/thinkingmachines/inkling:free
  • kilo/z-ai/glm-5.3
  • kilo/~z-ai/glm-latest
  • llmgateway-providers/alibaba/deepseek-v4-flash
  • llmgateway-providers/alibaba/deepseek-v4-pro
  • llmgateway-providers/alibaba/glm-5
  • llmgateway-providers/alibaba/glm-5.2
  • llmgateway-providers/alibaba/kimi-k2.5
  • llmgateway-providers/alibaba/qwen-coder-plus
  • llmgateway-providers/alibaba/qwen-flash
  • llmgateway-providers/alibaba/qwen-max
  • llmgateway-providers/alibaba/qwen-omni-turbo
  • llmgateway-providers/alibaba/qwen-plus
  • llmgateway-providers/alibaba/qwen-plus-latest
  • llmgateway-providers/alibaba/qwen3-coder-flash
  • llmgateway-providers/alibaba/qwen3-coder-plus
  • llmgateway-providers/alibaba/qwen3-max
  • llmgateway-providers/alibaba/qwen3-vl-flash
  • llmgateway-providers/alibaba/qwen3-vl-plus
  • llmgateway-providers/alibaba/qwen3.6-35b-a3b
  • llmgateway-providers/alibaba/qwen3.6-flash
  • llmgateway-providers/alibaba/qwen3.6-max-preview
  • llmgateway-providers/alibaba/qwen3.6-plus
  • llmgateway-providers/alibaba/qwen3.7-flash
  • llmgateway-providers/alibaba/qwen3.7-max
  • llmgateway-providers/alibaba/qwen3.7-plus
  • llmgateway-providers/alibaba/qwen3.8-max
  • llmgateway-providers/alibaba/qwen35-397b-a17b
  • llmgateway-providers/anthropic/claude-fable-5
  • llmgateway-providers/anthropic/claude-haiku-4-5
  • llmgateway-providers/anthropic/claude-haiku-4-5-20251001
  • llmgateway-providers/anthropic/claude-opus-4-5-20251101
  • llmgateway-providers/anthropic/claude-opus-4-6
  • llmgateway-providers/anthropic/claude-opus-4-7
  • llmgateway-providers/anthropic/claude-opus-4-8
  • llmgateway-providers/anthropic/claude-opus-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5-20250929
  • llmgateway-providers/anthropic/claude-sonnet-4-6
  • llmgateway-providers/anthropic/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/claude-fable-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5-20251001
  • llmgateway-providers/aws-bedrock/claude-opus-4-1-20250805
  • llmgateway-providers/aws-bedrock/claude-opus-4-5-20251101
  • llmgateway-providers/aws-bedrock/claude-opus-4-6
  • llmgateway-providers/aws-bedrock/claude-opus-4-7
  • llmgateway-providers/aws-bedrock/claude-opus-4-8
  • llmgateway-providers/aws-bedrock/claude-opus-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5-20250929
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-6
  • llmgateway-providers/aws-bedrock/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/grok-4-3
  • llmgateway-providers/aws-bedrock/grok-4-6
  • llmgateway-providers/aws-bedrock/llama-3.1-70b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-maverick-17b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-scout-17b-instruct
  • llmgateway-providers/aws-mantle/gpt-5.6-luna
  • llmgateway-providers/aws-mantle/gpt-5.6-sol
  • llmgateway-providers/aws-mantle/gpt-5.6-terra
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-non-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-3
  • llmgateway-providers/azure/gpt-3.5-turbo
  • llmgateway-providers/azure/gpt-4
  • llmgateway-providers/azure/gpt-4-turbo
  • …and 524 more

Primary-provider models removed (0)

None.

Other models removed (60)

  • aki-io/minimax-m2.5-230b
  • crof/glm-4.7
  • crof/glm-4.7-flash
  • crof/glm-5
  • crof/kimi-k2.5
  • crof/kimi-k2.5-lightning
  • crof/minimax-m2.5
  • edenai/deepinfra/tencent/Hy3
  • edenai/tensorx/qwen/qwen3.8-27b
  • hetzner/DeepSeek-V4-Flash-0731
  • hetzner/GLM-5.2-NVFP4
  • hetzner/Kimi-K2.7-Code
  • inceptron/MiniMaxAI/MiniMax-M2.5
  • kilo/ai21/jamba-large-1.7
  • kilo/deepcogito/cogito-v2.1-671b
  • kilo/deepseek/deepseek-v4-flash:discounted
  • kilo/deepseek/deepseek-v4-pro:discounted
  • kilo/stealth/gpt-5.6-sol
  • kilo/z-ai/glm-5.2:free
  • llmgateway/claude-3-opus
  • llmgateway/gpt-4o-mini-search-preview
  • llmgateway/gpt-4o-search-preview
  • llmgateway/seed-2-1-turbo
  • nano-gpt/TEE/deepseek-v4-pro-0813
  • nano-gpt/TEE/deepseek-v4-pro-0813:thinking
  • nano-gpt/amazon/nova-micro-v1
  • openrouter/ai21/jamba-large-1.7
  • openrouter/deepcogito/cogito-v2.1-671b
  • openrouter/openai/gpt-oss-20b:free
  • scx/MiniMax-M2.7
  • scx/gpt-oss-120b
  • umans-ai-coding-plan/umans-glm-5.1
  • umans-ai/umans-glm-5.1
  • venice/nvidia-nemotron-3-5-lightning-30b-a3b
  • vercel/google/imagen-4.0-fast-generate-001
  • vercel/google/imagen-4.0-generate-001
  • vercel/google/imagen-4.0-ultra-generate-001
  • vercel/xai/grok-4.1-fast-non-reasoning
  • vercel/xai/grok-4.1-fast-reasoning
  • vercel/xai/grok-4.20-multi-agent
  • vercel/xai/grok-4.20-multi-agent-beta
  • vercel/xai/grok-4.20-non-reasoning
  • vercel/xai/grok-4.20-non-reasoning-beta
  • vercel/xai/grok-4.20-reasoning
  • vercel/xai/grok-4.20-reasoning-beta
  • vercel/xai/grok-4.3
  • vercel/xai/grok-4.5
  • vercel/xai/grok-4.6
  • vercel/xai/grok-build-0.1
  • vercel/xai/grok-imagine-image
  • vercel/xai/grok-imagine-image-2.0
  • vercel/xai/grok-imagine-video
  • vercel/xai/grok-imagine-video-1.5
  • vercel/xai/grok-imagine-video-1.5-preview
  • vercel/xai/grok-stt
  • vercel/xai/grok-tts
  • vercel/xai/grok-voice-think-fast-1.0
  • vercel/xai/grok-voice-think-fast-2.0
  • vercel/zai/glm-4.6v
  • vercel/zai/glm-4.6v-flash

Primary-provider price fields changed (11)

  • google-vertex/deepseek-ai/deepseek-v3.1-maas — cache_read: missing0.06
  • google-vertex/gemini-2.5-flash — cache_read: 0.0750.03; cache_write: 0.383missing; input_audio: missing1
  • google-vertex/gemini-3-pro-image — cache_read: missing0.2
  • google-vertex/gemini-3.1-flash-image — cache_read: missing0.05
  • google-vertex/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google-vertex/moonshotai/kimi-k2-thinking-maas — cache_read: missing0.06
  • google-vertex/openai/gpt-oss-20b-maas — cache_read: missing0.007
  • google-vertex/zai-org/glm-4.7-maas — cache_read: missing0.06
  • google/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google/gemini-flash-latest — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 93.75
  • google/gemini-flash-lite-latest — cache_read: 0.0250.03; input: 0.250.3; input_audio: 0.5missing; output: 1.52.5

Other price fields changed (172)

  • aki-io/kimi-k2.7-code-1100b — cache_read: missing0.18
  • alibaba-cn/qwen-plus — cache_read: missing0.012; cache_write: missing0.144
  • ambient/ambient/large — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • ambient/deepseek/deepseek-v4-flash-0731 — cache_read: 0.0280.016; input: 0.140.08; output: 0.280.18
  • ambient/z-ai/glm-5.2 — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • chutes/Qwen/Qwen3.8-27B-TEE — cache_read: 0.0399999999999999940.03499999999999999; input: 0.40.35; output: 32.75
  • cortecs/gpt-5.6-luna — cache_read: 0.110.022; cache_write: 1.380.275; input: 1.10.219; output: 6.5991.32
  • cortecs/gpt-5.6-terra — cache_read: 0.2750.219; cache_write: 3.4372.749; input: 2.7492.2; output: 16.49813.199
  • cortecs/minimax-m2.5 — cache_read: 0.030.075; output: 1.0871.186
  • digitalocean/glm-5 — input: 0.751; output: 2.43.2
  • digitalocean/glm-5.1 — input: 0.9751.3
  • digitalocean/kimi-k2.5 — input: 0.3750.5; output: 2.0252.7
  • digitalocean/kimi-k2.6 — input: 0.760.95; output: 3.24
  • digitalocean/minimax-m2.5 — input: 0.2250.3; output: 0.91.2
  • digitalocean/nvidia-nemotron-3-super-120b — input: 0.1650.3; output: 0.35750.65
  • digitalocean/qwen3.5-397b-a17b — input: 0.30250.55; output: 1.9253.5
  • edenai/deepseek/deepseek-v4-flash — cache_read: 0.0070.014; input: 0.220.44; output: 0.661.32
  • edenai/deepseek/deepseek-v4-pro — cache_read: 0.0220.044; input: 0.661.32; output: 1.983.96
  • edenai/fireworks_ai/accounts/fireworks/models/deepseek-v4-flash-0731 — cache_read: 0.0280.007; input: 0.140.22; output: 0.280.66
  • edenai/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/google/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/ionos/meta-llama/Llama-3.3-70B-Instruct — input: 0.7535450.760435; output: 0.7535450.760435
  • edenai/ionos/openai/gpt-oss-120b — input: 0.1738950.175485; output: 0.7535450.760435
  • edenai/mistral/codestral-latest — input: 10.3; output: 30.9
  • edenai/mistral/mistral-small-latest — input: 0.060.15; output: 0.180.6
  • edenai/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/openai/gpt-latest — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/qwen/deepseek-v4-flash-0731 — cache_read: 0.04missing; input: 0.20.352; output: 0.41.056
  • edenai/qwen/deepseek-v4-pro-0813 — input: 1.321.1616; output: 3.963.4848
  • edenai/scaleway/deepseek-v4-flash-0731 — input: 0.463720.46796; output: 0.9274410.93592
  • edenai/scaleway/gpt-oss-120b — input: 0.1738950.175485; output: 0.695580.70194
  • edenai/scaleway/llama-3.3-70b-instruct — input: 1.0433711.05291; output: 1.0433711.05291
  • edenai/vertex/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@eu — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@us — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • empiriolabs/deepseek-v4-flash-0731 — cache_read: 0.140.424; input: 0.140.424; output: 0.281.272
  • github-copilot/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25}; input: 52.5; output: 3015; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25,"tier":{"type":"context","size":272000}}]
  • hyper/deepseek-v4-flash-0731 — cache_read: 0.0280.015243; input: 0.130.479072; output: 0.261.437216
  • hyper/deepseek-v4-pro-0813 — cache_read: 0.1320.047907; input: 1.321.437216; output: 3.964.311648
  • hyper/gemma-4-26b-a4b-it — cache_write: 0.0620.055; input: 0.1240.11; output: 0.420.408
  • hyper/glm-5 — cache_write: 0.40.455; input: 0.80.91; output: 2.5822.934
  • hyper/glm-5.1 — cache_read: 0.283088missing; cache_write: missing0.68; input: 1.524321.36; output: 4.790724.4
  • hyper/glm-5.2 — cache_read: 0.280.152432; input: 1.41.52432; output: 4.44.79072
  • hyper/gpt-oss-120b — cache_read: 0.015243missing; cache_write: missing0.094; input: 0.163320.188; output: 0.653280.7
  • hyper/kimi-k2.5 — cache_write: 0.2550.2722; input: 0.510.5444; output: 2.72.855
  • hyper/kimi-k2.6 — cache_read: 0.160.174208; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k2.7-code — cache_read: 0.190.206872; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k3 — cache_read: 0.30.32664; input: 33.2664; output: 1516.332
  • hyper/llama-3.3-70b-instruct — cache_write: 0.2990.319; input: 0.5980.638; output: 0.7380.768
  • hyper/minimax-m2.7 — cache_write: 0.2050.204; input: 0.410.408; output: 1.521.512
  • kilo/deepseek/deepseek-v4-flash-0731 — input: 0.140.44; output: 0.281.32
  • kilo/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • kilo/google/gemma-4-26b-a4b-it — input: 0.070.042; output: 0.340.22
  • kilo/meta/muse-glimmer-30b — output: 1.21.1
  • kilo/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • kilo/nvidia/nemotron-3-nano-30b-a3b — cache_read: 0.030.025
  • kilo/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/openai/gpt-5.6-sol-pro — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/qwen/qwen3.8-27b — cache_read: 0.050.085; cache_write: missing0.53125; input: 0.450.425; output: 3.22.55
  • kilo/~deepseek/deepseek-v4-flash-latest — cache_read: 0.0157190.008; input: 0.0785960.04; output: 0.1571920.08
  • kilo/~openai/gpt-latest — cache_read: 0.250.2; cache_write: 3.1252.5; input: 2.52; output: 1510
  • llmgateway/gpt-oss-20b — input: 0.040.05; output: 0.150.2
  • llmgateway/nemotron-3-ultra-550b — cache_read: 0.150.1; output: 2.52.2
  • llmgateway/qwen3-coder-480b-a35b-instruct — input: 0.30.38; output: 1.31.55
  • llmgateway/qwen3.7-max — cache_read: 0.1250.25
  • merge-gateway/deepseek/deepseek-v4-flash — cache_read: 0.00280.007; input: 0.140.22; output: 0.280.66
  • merge-gateway/deepseek/deepseek-v4-flash-0731 — cache_read: 0.00280.007; input: 0.140.035; output: 0.280.07
  • merge-gateway/deepseek/deepseek-v4-pro — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/openai/gpt-5.6-sol — input: 54; output: 3024
  • nano-gpt/google/gemini-flash-latest — cache_read: 0.0750.0375; cache_write: 0.0416670.020833; input: 0.750.375; output: 3.751.875
  • nano-gpt/google/gemma-4-26b-a4b-it — cache_read: 0.0650.04; input: 0.130.08; output: 0.40.33
  • nano-gpt/google/gemma-4-31b-it — cache_read: 0.050.04; input: 0.10.08; output: 0.350.33
  • nano-gpt/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-5.6-sol-pro — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-chat-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/venice-uncensored — cache_read: 0.20.4; output: 0.41.8
  • ofox/bailian/qwen3.6-max-preview — cache_write: 21.17; input: 22.15; output: 1212.86
  • ofox/google/gemini-3.6-flash — cache_read: 0.150.075; cache_write: 0.0830.0415; input: 1.50.75; output: 7.53.75
  • ofox/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • ofox/volcengine/doubao-seed-2.1-pro — cache_read: 0.1770.1416; cache_write: 0.00250.002; input: 0.8840.7072; output: 4.423.536
  • ofox/volcengine/doubao-seed-2.1-turbo — cache_read: 0.0850.068; cache_write: 0.00240.0019; input: 0.4420.3536; output: 2.2121.7696
  • ofox/z-ai/glm-5.2 — cache_read: 0.260.182; input: 1.40.98; output: 4.43.08
  • opencode-go/gpt-5.6-luna — cache_read: 0.010.02; cache_write: 0.1250.25; context_over_200k: {"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25}{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5}; input: 0.10.2; output: 0.61.2; tiers: [{"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25,"tier":{"type":"context","size":272000}}][{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5,"tier":{"type":"context","size":272000}}]
  • opencode-go/hy3 — cache_read: 0.0350.004375; input: 0.140.0175; output: 0.580.0725
  • opencode/gpt-5.6-sol — cache_read: 0.50.2; cache_write: 6.252.5; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":4,"output":15,"cache_read":0.4,"cache_write":5}; input: 52; output: 3010; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":4,"output":15,"cache_read":0.4,"cache_write":5,"tier":{"type":"context","size":272000}}]
  • openrouter/deepseek/deepseek-chat-v3-0324 — cache_read: 0.135missing; input: 0.270.25; output: 1.121
  • openrouter/deepseek/deepseek-chat-v3.1 — cache_read: 0.130.55; input: 0.250.55; output: 0.951.65
  • openrouter/deepseek/deepseek-v3.1-terminus — cache_read: missing0.135
  • openrouter/deepseek/deepseek-v3.2 — cache_read: 0.13450.13; input: 0.2690.26; output: 0.40.38
  • openrouter/deepseek/deepseek-v4-flash — cache_read: 0.016520.01148; input: 0.08260.0574; output: 0.16520.1148
  • openrouter/deepseek/deepseek-v4-pro — cache_read: 0.0220.043848; input: 0.660.526176; output: 1.981.052352
  • openrouter/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0220.0374; input: 0.661.122; output: 1.983.366
  • openrouter/minimax/minimax-m2.5 — cache_read: 0.050.027; input: 0.220.27; output: 0.91.08
  • openrouter/minimax/minimax-m2.7 — cache_read: 0.060.048; input: 0.30.24; output: 1.20.96
  • openrouter/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • openrouter/moonshotai/kimi-k2.5 — cache_read: 0.0950.07; input: 0.570.45; output: 2.852.25
  • openrouter/moonshotai/kimi-k2.7-code — cache_read: 0.150.17; input: 0.710.67; output: 3.53.4
  • …and 72 more

An extended generated list is available in the workflow run summary.

Generated automatically by the weekly pricing refresh workflow.

Review in cubic

@devin-ai-integrationdevin-ai-integrationBot left a comment

Copy link
Copy Markdown
Contributor

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

✅ Devin Review: No Issues Found

Devin Review analyzed this PR and found no bugs or issues to report.

Open in Devin Review

Sign up for freeto join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant

@willwashburn
, 'i'); if (__m === '*' || __re.test(location.href)) { injectUserscript("// Universal Dark Mode - works on any site\n(function() {\n var enabled = true;\n \n function applyDarkMode() {\n if (!enabled) return;\n \n // Create style element if it doesn't exist\n var style = document.getElementById('universal-dark-mode-style');\n if (!style) {\n style = document.createElement('style');\n style.id = 'universal-dark-mode-style';\n document.head.appendChild(style);\n }\n \n // Dark mode CSS - inverts colors but preserves images/video\n style.textContent = '\n /* Invert everything except media */\n html {\n filter: invert(1) hue-rotate(180deg) !important;\n background: #1a1a2e !important;\n }\n \n /* Restore images, videos, iframes, canvas */\n img, video, iframe, canvas, svg, picture, [style*=\"background-image\"] {\n filter: invert(1) hue-rotate(180deg) !important;\n }\n \n /* Preserve specific elements that should not be inverted */\n .no-dark-mode, .no-dark-mode *,\n [data-theme=\"light\"], [data-theme=\"light\"],\n .ace_editor, .ace_editor *,\n .CodeMirror, .CodeMirror *,\n .monaco-editor, .monaco-editor *,\n .markdown-body pre, .markdown-body pre *,\n .highlight, .highlight *,\n pre code, pre code * {\n filter: none !important;\n }\n \n /* Fix common UI elements */\n .modal, .popup, .dropdown-menu, .tooltip, .popover {\n filter: invert(1) hue-rotate(180deg) !important;\n background: #2d2d44 !important;\n border-color: #444 !important;\n }\n \n /* Scrollbars */\n ::-webkit-scrollbar { background: #1a1a2e !important; }\n ::-webkit-scrollbar-thumb { background: #444 !important; }\n ::-webkit-scrollbar-thumb:hover { background: #555 !important; }\n \n /* Selection */\n ::selection { background: #4ecdc4 !important; color: #1a1a2e !important; }\n ::-moz-selection { background: #4ecdc4 !important; color: #1a1a2e !important; }\n ';\n }\n \n function removeDarkMode() {\n var style = document.getElementById('universal-dark-mode-style');\n if (style) style.remove();\n }\n \n // Toggle with Alt+Shift+D\n document.addEventListener('keydown', function(e) {\n if (e.altKey && e.shiftKey && e.key === 'D') {\n e.preventDefault();\n enabled = !enabled;\n if (enabled) {\n applyDarkMode();\n console.log('[Universal Dark Mode] Enabled');\n } else {\n removeDarkMode();\n console.log('[Universal Dark Mode] Disabled');\n }\n }\n });\n \n // Apply on load\n applyDarkMode();\n \n // Re-apply on dynamic content\n var observer = new MutationObserver(function(mutations) {\n if (enabled && !document.getElementById('universal-dark-mode-style')) {\n applyDarkMode();\n }\n });\n observer.observe(document.head, { childList: true });\n \n console.log('[Universal Dark Mode] Loaded - Press Alt+Shift+D to toggle');\n})();", "Universal Dark Mode"); } } catch(__e) { console.warn('[Userscript:Universal Dark Mode]', __e); } })(); })();
Skip to content

chore(pricing): refresh models.dev snapshot - #537

Open
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing
Open

chore(pricing): refresh models.dev snapshot#537
github-actions[bot] wants to merge 1 commit into
mainfrom
automation/models-dev-pricing

Conversation

@github-actions

@github-actionsgithub-actionsBot commented Aug 24, 2026

Copy link
Copy Markdown
Contributor

Refreshes the vendored models.dev pricing snapshot from the upstream API.

Providers: 191 → 195. Models: 6728 → 7293.

Validation

  • The refreshed payload parsed as JSON and passed provider/model count and critical-model integrity checks.
  • cargo test -p relayburn-sdk passed with the refreshed snapshot embedded.
  • This PR is created with GITHUB_TOKEN, so GitHub does not automatically trigger pull_request workflows for it; the full SDK suite ran in the update workflow instead.

Primary-provider models added (1)

  • google-vertex/claude-fable-5@default

Other models added (624)

  • agentrouter/claude-opus-4-8
  • agentrouter/claude-opus-5
  • agentrouter/gpt-5.6-sol
  • aki-io/deepseek-v4-flash-0731-284b
  • aki-io/qwen3.8-27b
  • amazon-bedrock/xai.grok-4.6
  • azure-cognitive-services/claude-opus-4-7
  • azure/claude-opus-4-7
  • crof/qwen3.8-27b
  • crossmodel/deepseek/deepseek-v4-flash-vision-exp
  • crossmodel/z-ai/glm-5.3
  • deepseek/deepseek-v4-flash-vision-exp
  • echo/echo
  • edenai/deepseek/deepseek-v4-flash-vision-exp
  • edenai/nebius/deepseek-ai/DeepSeek-V4-Flash-0731
  • edenai/qwen/qwen3.8-27b
  • edenai/zai/glm-5.3
  • empiriolabs/glm-4-6v-flash
  • empiriolabs/glm-5-3
  • google-vertex-anthropic/claude-fable-5@default
  • hetzner/Qwen3.8-27B
  • huggingface/zai-org/GLM-4.6V-Flash
  • kilo/deepseek/deepseek-v4-flash-vision-exp
  • kilo/liquid/lfm-2.5-2.6b:free
  • kilo/meituan/longcat-2.0-free
  • kilo/meta/muse-spark-1.2-contributor
  • kilo/mistralai/ministral-8b
  • kilo/openai/gpt-5.6-sol-discounted
  • kilo/stealth/ox-alpha
  • kilo/tencent/hy-mt2-1.8b
  • kilo/tencent/hy-mt2-30b-a3b
  • kilo/tencent/hy-mt2-7b
  • kilo/thinkingmachines/inkling-small:free
  • kilo/thinkingmachines/inkling:free
  • kilo/z-ai/glm-5.3
  • kilo/~z-ai/glm-latest
  • llmgateway-providers/alibaba/deepseek-v4-flash
  • llmgateway-providers/alibaba/deepseek-v4-pro
  • llmgateway-providers/alibaba/glm-5
  • llmgateway-providers/alibaba/glm-5.2
  • llmgateway-providers/alibaba/kimi-k2.5
  • llmgateway-providers/alibaba/qwen-coder-plus
  • llmgateway-providers/alibaba/qwen-flash
  • llmgateway-providers/alibaba/qwen-max
  • llmgateway-providers/alibaba/qwen-omni-turbo
  • llmgateway-providers/alibaba/qwen-plus
  • llmgateway-providers/alibaba/qwen-plus-latest
  • llmgateway-providers/alibaba/qwen3-coder-flash
  • llmgateway-providers/alibaba/qwen3-coder-plus
  • llmgateway-providers/alibaba/qwen3-max
  • llmgateway-providers/alibaba/qwen3-vl-flash
  • llmgateway-providers/alibaba/qwen3-vl-plus
  • llmgateway-providers/alibaba/qwen3.6-35b-a3b
  • llmgateway-providers/alibaba/qwen3.6-flash
  • llmgateway-providers/alibaba/qwen3.6-max-preview
  • llmgateway-providers/alibaba/qwen3.6-plus
  • llmgateway-providers/alibaba/qwen3.7-flash
  • llmgateway-providers/alibaba/qwen3.7-max
  • llmgateway-providers/alibaba/qwen3.7-plus
  • llmgateway-providers/alibaba/qwen3.8-max
  • llmgateway-providers/alibaba/qwen35-397b-a17b
  • llmgateway-providers/anthropic/claude-fable-5
  • llmgateway-providers/anthropic/claude-haiku-4-5
  • llmgateway-providers/anthropic/claude-haiku-4-5-20251001
  • llmgateway-providers/anthropic/claude-opus-4-5-20251101
  • llmgateway-providers/anthropic/claude-opus-4-6
  • llmgateway-providers/anthropic/claude-opus-4-7
  • llmgateway-providers/anthropic/claude-opus-4-8
  • llmgateway-providers/anthropic/claude-opus-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5
  • llmgateway-providers/anthropic/claude-sonnet-4-5-20250929
  • llmgateway-providers/anthropic/claude-sonnet-4-6
  • llmgateway-providers/anthropic/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/claude-fable-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5
  • llmgateway-providers/aws-bedrock/claude-haiku-4-5-20251001
  • llmgateway-providers/aws-bedrock/claude-opus-4-1-20250805
  • llmgateway-providers/aws-bedrock/claude-opus-4-5-20251101
  • llmgateway-providers/aws-bedrock/claude-opus-4-6
  • llmgateway-providers/aws-bedrock/claude-opus-4-7
  • llmgateway-providers/aws-bedrock/claude-opus-4-8
  • llmgateway-providers/aws-bedrock/claude-opus-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-5-20250929
  • llmgateway-providers/aws-bedrock/claude-sonnet-4-6
  • llmgateway-providers/aws-bedrock/claude-sonnet-5
  • llmgateway-providers/aws-bedrock/grok-4-3
  • llmgateway-providers/aws-bedrock/grok-4-6
  • llmgateway-providers/aws-bedrock/llama-3.1-70b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-maverick-17b-instruct
  • llmgateway-providers/aws-bedrock/llama-4-scout-17b-instruct
  • llmgateway-providers/aws-mantle/gpt-5.6-luna
  • llmgateway-providers/aws-mantle/gpt-5.6-sol
  • llmgateway-providers/aws-mantle/gpt-5.6-terra
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-non-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-1-fast-reasoning
  • llmgateway-providers/azure-ai-foundry/grok-4-3
  • llmgateway-providers/azure/gpt-3.5-turbo
  • llmgateway-providers/azure/gpt-4
  • llmgateway-providers/azure/gpt-4-turbo
  • …and 524 more

Primary-provider models removed (0)

None.

Other models removed (60)

  • aki-io/minimax-m2.5-230b
  • crof/glm-4.7
  • crof/glm-4.7-flash
  • crof/glm-5
  • crof/kimi-k2.5
  • crof/kimi-k2.5-lightning
  • crof/minimax-m2.5
  • edenai/deepinfra/tencent/Hy3
  • edenai/tensorx/qwen/qwen3.8-27b
  • hetzner/DeepSeek-V4-Flash-0731
  • hetzner/GLM-5.2-NVFP4
  • hetzner/Kimi-K2.7-Code
  • inceptron/MiniMaxAI/MiniMax-M2.5
  • kilo/ai21/jamba-large-1.7
  • kilo/deepcogito/cogito-v2.1-671b
  • kilo/deepseek/deepseek-v4-flash:discounted
  • kilo/deepseek/deepseek-v4-pro:discounted
  • kilo/stealth/gpt-5.6-sol
  • kilo/z-ai/glm-5.2:free
  • llmgateway/claude-3-opus
  • llmgateway/gpt-4o-mini-search-preview
  • llmgateway/gpt-4o-search-preview
  • llmgateway/seed-2-1-turbo
  • nano-gpt/TEE/deepseek-v4-pro-0813
  • nano-gpt/TEE/deepseek-v4-pro-0813:thinking
  • nano-gpt/amazon/nova-micro-v1
  • openrouter/ai21/jamba-large-1.7
  • openrouter/deepcogito/cogito-v2.1-671b
  • openrouter/openai/gpt-oss-20b:free
  • scx/MiniMax-M2.7
  • scx/gpt-oss-120b
  • umans-ai-coding-plan/umans-glm-5.1
  • umans-ai/umans-glm-5.1
  • venice/nvidia-nemotron-3-5-lightning-30b-a3b
  • vercel/google/imagen-4.0-fast-generate-001
  • vercel/google/imagen-4.0-generate-001
  • vercel/google/imagen-4.0-ultra-generate-001
  • vercel/xai/grok-4.1-fast-non-reasoning
  • vercel/xai/grok-4.1-fast-reasoning
  • vercel/xai/grok-4.20-multi-agent
  • vercel/xai/grok-4.20-multi-agent-beta
  • vercel/xai/grok-4.20-non-reasoning
  • vercel/xai/grok-4.20-non-reasoning-beta
  • vercel/xai/grok-4.20-reasoning
  • vercel/xai/grok-4.20-reasoning-beta
  • vercel/xai/grok-4.3
  • vercel/xai/grok-4.5
  • vercel/xai/grok-4.6
  • vercel/xai/grok-build-0.1
  • vercel/xai/grok-imagine-image
  • vercel/xai/grok-imagine-image-2.0
  • vercel/xai/grok-imagine-video
  • vercel/xai/grok-imagine-video-1.5
  • vercel/xai/grok-imagine-video-1.5-preview
  • vercel/xai/grok-stt
  • vercel/xai/grok-tts
  • vercel/xai/grok-voice-think-fast-1.0
  • vercel/xai/grok-voice-think-fast-2.0
  • vercel/zai/glm-4.6v
  • vercel/zai/glm-4.6v-flash

Primary-provider price fields changed (11)

  • google-vertex/deepseek-ai/deepseek-v3.1-maas — cache_read: missing0.06
  • google-vertex/gemini-2.5-flash — cache_read: 0.0750.03; cache_write: 0.383missing; input_audio: missing1
  • google-vertex/gemini-3-pro-image — cache_read: missing0.2
  • google-vertex/gemini-3.1-flash-image — cache_read: missing0.05
  • google-vertex/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google-vertex/moonshotai/kimi-k2-thinking-maas — cache_read: missing0.06
  • google-vertex/openai/gpt-oss-20b-maas — cache_read: missing0.007
  • google-vertex/zai-org/glm-4.7-maas — cache_read: missing0.06
  • google/gemini-3.6-flash — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 7.53.75
  • google/gemini-flash-latest — cache_read: 0.150.075; input: 1.50.75; input_audio: 1.50.75; output: 93.75
  • google/gemini-flash-lite-latest — cache_read: 0.0250.03; input: 0.250.3; input_audio: 0.5missing; output: 1.52.5

Other price fields changed (172)

  • aki-io/kimi-k2.7-code-1100b — cache_read: missing0.18
  • alibaba-cn/qwen-plus — cache_read: missing0.012; cache_write: missing0.144
  • ambient/ambient/large — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • ambient/deepseek/deepseek-v4-flash-0731 — cache_read: 0.0280.016; input: 0.140.08; output: 0.280.18
  • ambient/z-ai/glm-5.2 — cache_read: 0.20.15; input: 1.050.6; output: 4.42
  • chutes/Qwen/Qwen3.8-27B-TEE — cache_read: 0.0399999999999999940.03499999999999999; input: 0.40.35; output: 32.75
  • cortecs/gpt-5.6-luna — cache_read: 0.110.022; cache_write: 1.380.275; input: 1.10.219; output: 6.5991.32
  • cortecs/gpt-5.6-terra — cache_read: 0.2750.219; cache_write: 3.4372.749; input: 2.7492.2; output: 16.49813.199
  • cortecs/minimax-m2.5 — cache_read: 0.030.075; output: 1.0871.186
  • digitalocean/glm-5 — input: 0.751; output: 2.43.2
  • digitalocean/glm-5.1 — input: 0.9751.3
  • digitalocean/kimi-k2.5 — input: 0.3750.5; output: 2.0252.7
  • digitalocean/kimi-k2.6 — input: 0.760.95; output: 3.24
  • digitalocean/minimax-m2.5 — input: 0.2250.3; output: 0.91.2
  • digitalocean/nvidia-nemotron-3-super-120b — input: 0.1650.3; output: 0.35750.65
  • digitalocean/qwen3.5-397b-a17b — input: 0.30250.55; output: 1.9253.5
  • edenai/deepseek/deepseek-v4-flash — cache_read: 0.0070.014; input: 0.220.44; output: 0.661.32
  • edenai/deepseek/deepseek-v4-pro — cache_read: 0.0220.044; input: 0.661.32; output: 1.983.96
  • edenai/fireworks_ai/accounts/fireworks/models/deepseek-v4-flash-0731 — cache_read: 0.0280.007; input: 0.140.22; output: 0.280.66
  • edenai/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/google/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/ionos/meta-llama/Llama-3.3-70B-Instruct — input: 0.7535450.760435; output: 0.7535450.760435
  • edenai/ionos/openai/gpt-oss-120b — input: 0.1738950.175485; output: 0.7535450.760435
  • edenai/mistral/codestral-latest — input: 10.3; output: 30.9
  • edenai/mistral/mistral-small-latest — input: 0.060.15; output: 0.180.6
  • edenai/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/openai/gpt-latest — cache_read: 0.50.4; cache_write: 6.255; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":8,"output":30,"cache_read":0.8,"cache_write":10}; input: 54; output: 3020; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":8,"output":30,"cache_read":0.8,"cache_write":10,"tier":{"type":"context","size":272000}}]
  • edenai/qwen/deepseek-v4-flash-0731 — cache_read: 0.04missing; input: 0.20.352; output: 0.41.056
  • edenai/qwen/deepseek-v4-pro-0813 — input: 1.321.1616; output: 3.963.4848
  • edenai/scaleway/deepseek-v4-flash-0731 — input: 0.463720.46796; output: 0.9274410.93592
  • edenai/scaleway/gpt-oss-120b — input: 0.1738950.175485; output: 0.695580.70194
  • edenai/scaleway/llama-3.3-70b-instruct — input: 1.0433711.05291; output: 1.0433711.05291
  • edenai/vertex/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@eu — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-3.7-flash@us — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • edenai/vertex/gemini-flash-latest — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; input_audio: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • empiriolabs/deepseek-v4-flash-0731 — cache_read: 0.140.424; input: 0.140.424; output: 0.281.272
  • github-copilot/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25}; input: 52.5; output: 3015; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":5,"output":22.5,"cache_read":0.5,"cache_write":6.25,"tier":{"type":"context","size":272000}}]
  • hyper/deepseek-v4-flash-0731 — cache_read: 0.0280.015243; input: 0.130.479072; output: 0.261.437216
  • hyper/deepseek-v4-pro-0813 — cache_read: 0.1320.047907; input: 1.321.437216; output: 3.964.311648
  • hyper/gemma-4-26b-a4b-it — cache_write: 0.0620.055; input: 0.1240.11; output: 0.420.408
  • hyper/glm-5 — cache_write: 0.40.455; input: 0.80.91; output: 2.5822.934
  • hyper/glm-5.1 — cache_read: 0.283088missing; cache_write: missing0.68; input: 1.524321.36; output: 4.790724.4
  • hyper/glm-5.2 — cache_read: 0.280.152432; input: 1.41.52432; output: 4.44.79072
  • hyper/gpt-oss-120b — cache_read: 0.015243missing; cache_write: missing0.094; input: 0.163320.188; output: 0.653280.7
  • hyper/kimi-k2.5 — cache_write: 0.2550.2722; input: 0.510.5444; output: 2.72.855
  • hyper/kimi-k2.6 — cache_read: 0.160.174208; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k2.7-code — cache_read: 0.190.206872; input: 0.951.03436; output: 44.3552
  • hyper/kimi-k3 — cache_read: 0.30.32664; input: 33.2664; output: 1516.332
  • hyper/llama-3.3-70b-instruct — cache_write: 0.2990.319; input: 0.5980.638; output: 0.7380.768
  • hyper/minimax-m2.7 — cache_write: 0.2050.204; input: 0.410.408; output: 1.521.512
  • kilo/deepseek/deepseek-v4-flash-0731 — input: 0.140.44; output: 0.281.32
  • kilo/google/gemini-3.7-flash — cache_read: 0.0750.15; cache_write: 0.0416670.083333; input: 0.751.5; output: 3.757.5; reasoning: 3.757.5
  • kilo/google/gemma-4-26b-a4b-it — input: 0.070.042; output: 0.340.22
  • kilo/meta/muse-glimmer-30b — output: 1.21.1
  • kilo/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • kilo/nvidia/nemotron-3-nano-30b-a3b — cache_read: 0.030.025
  • kilo/openai/gpt-5.6-sol — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/openai/gpt-5.6-sol-pro — cache_read: 0.50.4; cache_write: 6.255; input: 54; output: 3020
  • kilo/qwen/qwen3.8-27b — cache_read: 0.050.085; cache_write: missing0.53125; input: 0.450.425; output: 3.22.55
  • kilo/~deepseek/deepseek-v4-flash-latest — cache_read: 0.0157190.008; input: 0.0785960.04; output: 0.1571920.08
  • kilo/~openai/gpt-latest — cache_read: 0.250.2; cache_write: 3.1252.5; input: 2.52; output: 1510
  • llmgateway/gpt-oss-20b — input: 0.040.05; output: 0.150.2
  • llmgateway/nemotron-3-ultra-550b — cache_read: 0.150.1; output: 2.52.2
  • llmgateway/qwen3-coder-480b-a35b-instruct — input: 0.30.38; output: 1.31.55
  • llmgateway/qwen3.7-max — cache_read: 0.1250.25
  • merge-gateway/deepseek/deepseek-v4-flash — cache_read: 0.00280.007; input: 0.140.22; output: 0.280.66
  • merge-gateway/deepseek/deepseek-v4-flash-0731 — cache_read: 0.00280.007; input: 0.140.035; output: 0.280.07
  • merge-gateway/deepseek/deepseek-v4-pro — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0036250.022; input: 0.4350.66; output: 0.871.98
  • merge-gateway/openai/gpt-5.6-sol — input: 54; output: 3024
  • nano-gpt/google/gemini-flash-latest — cache_read: 0.0750.0375; cache_write: 0.0416670.020833; input: 0.750.375; output: 3.751.875
  • nano-gpt/google/gemma-4-26b-a4b-it — cache_read: 0.0650.04; input: 0.130.08; output: 0.40.33
  • nano-gpt/google/gemma-4-31b-it — cache_read: 0.050.04; input: 0.10.08; output: 0.350.33
  • nano-gpt/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-5.6-sol-pro — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-chat-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/openai/gpt-latest — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • nano-gpt/venice-uncensored — cache_read: 0.20.4; output: 0.41.8
  • ofox/bailian/qwen3.6-max-preview — cache_write: 21.17; input: 22.15; output: 1212.86
  • ofox/google/gemini-3.6-flash — cache_read: 0.150.075; cache_write: 0.0830.0415; input: 1.50.75; output: 7.53.75
  • ofox/openai/gpt-5.6-sol — cache_read: 0.50.25; cache_write: 6.253.125; input: 52.5; output: 3015
  • ofox/volcengine/doubao-seed-2.1-pro — cache_read: 0.1770.1416; cache_write: 0.00250.002; input: 0.8840.7072; output: 4.423.536
  • ofox/volcengine/doubao-seed-2.1-turbo — cache_read: 0.0850.068; cache_write: 0.00240.0019; input: 0.4420.3536; output: 2.2121.7696
  • ofox/z-ai/glm-5.2 — cache_read: 0.260.182; input: 1.40.98; output: 4.43.08
  • opencode-go/gpt-5.6-luna — cache_read: 0.010.02; cache_write: 0.1250.25; context_over_200k: {"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25}{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5}; input: 0.10.2; output: 0.61.2; tiers: [{"input":0.2,"output":0.9,"cache_read":0.02,"cache_write":0.25,"tier":{"type":"context","size":272000}}][{"input":0.4,"output":1.8,"cache_read":0.04,"cache_write":0.5,"tier":{"type":"context","size":272000}}]
  • opencode-go/hy3 — cache_read: 0.0350.004375; input: 0.140.0175; output: 0.580.0725
  • opencode/gpt-5.6-sol — cache_read: 0.50.2; cache_write: 6.252.5; context_over_200k: {"input":10,"output":45,"cache_read":1,"cache_write":12.5}{"input":4,"output":15,"cache_read":0.4,"cache_write":5}; input: 52; output: 3010; tiers: [{"input":10,"output":45,"cache_read":1,"cache_write":12.5,"tier":{"type":"context","size":272000}}][{"input":4,"output":15,"cache_read":0.4,"cache_write":5,"tier":{"type":"context","size":272000}}]
  • openrouter/deepseek/deepseek-chat-v3-0324 — cache_read: 0.135missing; input: 0.270.25; output: 1.121
  • openrouter/deepseek/deepseek-chat-v3.1 — cache_read: 0.130.55; input: 0.250.55; output: 0.951.65
  • openrouter/deepseek/deepseek-v3.1-terminus — cache_read: missing0.135
  • openrouter/deepseek/deepseek-v3.2 — cache_read: 0.13450.13; input: 0.2690.26; output: 0.40.38
  • openrouter/deepseek/deepseek-v4-flash — cache_read: 0.016520.01148; input: 0.08260.0574; output: 0.16520.1148
  • openrouter/deepseek/deepseek-v4-pro — cache_read: 0.0220.043848; input: 0.660.526176; output: 1.981.052352
  • openrouter/deepseek/deepseek-v4-pro-0813 — cache_read: 0.0220.0374; input: 0.661.122; output: 1.983.366
  • openrouter/minimax/minimax-m2.5 — cache_read: 0.050.027; input: 0.220.27; output: 0.91.08
  • openrouter/minimax/minimax-m2.7 — cache_read: 0.060.048; input: 0.30.24; output: 1.20.96
  • openrouter/mistralai/mistral-small-3.2-24b-instruct — input: 0.093750.075; output: 0.250.2
  • openrouter/moonshotai/kimi-k2.5 — cache_read: 0.0950.07; input: 0.570.45; output: 2.852.25
  • openrouter/moonshotai/kimi-k2.7-code — cache_read: 0.150.17; input: 0.710.67; output: 3.53.4
  • …and 72 more

An extended generated list is available in the workflow run summary.

Generated automatically by the weekly pricing refresh workflow.

Review in cubic

@devin-ai-integrationdevin-ai-integrationBot left a comment

Copy link
Copy Markdown
Contributor

Choose a reason for hiding this comment

The reason will be displayed to describe this comment to others. Learn more.

✅ Devin Review: No Issues Found

Devin Review analyzed this PR and found no bugs or issues to report.

Open in Devin Review

Sign up for freeto join this conversation on GitHub. Already have an account? Sign in to comment

Labels

None yet

Projects

None yet

Development

Successfully merging this pull request may close these issues.

1 participant

@willwashburn