deepseek/deepseek-v4-pro-0813
Fireworks
Status
Track model availability, pricing shifts, benchmark score changes, and description updates from the catalog history in one compact feed.
deepseek/deepseek-v4-pro-0813
Fireworks
Status
deepseek/deepseek-v4-pro-0813
Baseten
Status
google/gemini-3.7-flash
Google Ai Studio
Status
google/gemini-3.7-flash
Google Vertex
Status
google/gemini-3.7-flash
Status
deepseek/deepseek-v4-flash-0731
Deepseek
Standard
Standard
Standard
deepseek/deepseek-v4-pro-0813
Deepseek
Standard
Standard
Standard
nvidia/nemotron-3.5-lightning
Venice
Status
qwen/qwen3.8-2.4t-a95b
Together
Status
qwen/qwen3.8-max
Digitalocean
Status
Provider listing
qwen/qwen3.8-max
Fireworks
Status
Provider listing
qwen/qwen3.8-2.4t-a95b
Digitalocean
Status
qwen/qwen3.8-2.4t-a95b
Fireworks
Status
qwen/qwen3.8-max
Qwen
Unknown link
Description
Qwen 3.8 Max is Qwen's 2.4-trillion-parameter mixture-of-experts flagship for long-horizon coding and professional work, with 95 billion active parameters. Qwen Cloud adds native text, image and video understanding, a 1M-token context window, reasoning, function calling, structured outputs, caching, batches and web search; Qwen also publishes the text-only Qwen3.8-2.4T-A95B weights for self-hosting.
Qwen 3.8 Max is Qwen Cloud's managed multimodal flagship for complex reasoning, coding and professional work. It is based on Qwen3.8-2.4T-A95B but is a distinct API model with native text, image and video understanding, non-thinking support, a default 1M-token context window, function calling, structured outputs, caching, batches and built-in tools.
qwen/qwen3.8-2.4t-a95b
Qwen
Status
deepseek/deepseek-v4-pro
Deepseek
Status
deepseek/deepseek-v4-pro-0813
Deepseek
Status
spacex-ai/grok-4.6
SpaceXAI
Status
qwen/qwen3.8-max
Digitalocean
Status
qwen/qwen3.8-max
Fireworks
Status
deepseek/deepseek-v4-pro-0813
Deepseek
Status
spacex-ai/grok-4.6
SpaceXAI
Status
qwen/qwen3.8-max
Qwen
Unknown link
Description
Qwen 3.8 Max is Qwen's proprietary 2.4-trillion-parameter mixture-of-experts flagship for long-horizon coding and professional work. It supports native text, image and video understanding, a 1M-token context window, reasoning, function calling, structured outputs, caching, batches and web search.
Qwen 3.8 Max is Qwen's 2.4-trillion-parameter mixture-of-experts flagship for long-horizon coding and professional work, with 95 billion active parameters. Qwen Cloud adds native text, image and video understanding, a 1M-token context window, reasoning, function calling, structured outputs, caching, batches and web search; Qwen also publishes the text-only Qwen3.8-2.4T-A95B weights for self-hosting.
anthropic/claude-fable-5
Azure
Status
anthropic/claude-haiku-4.5
Azure
Status
anthropic/claude-opus-4.5
Azure
Status
anthropic/claude-opus-4.6
Azure
Status
anthropic/claude-opus-4.7
Azure
Status
anthropic/claude-opus-4.7-fast
Kilo
Status
Provider listing
anthropic/claude-opus-4.7-fast
Openrouter
Status
Provider listing
anthropic/claude-opus-4.7-fast
Venice
Status
Provider listing
anthropic/claude-opus-4.7-fast
Vercel
Status
Provider listing
anthropic/claude-opus-4.8
Azure
Status
anthropic/claude-opus-5
Azure
Status
anthropic/claude-sonnet-4.5
Azure
Status
anthropic/claude-sonnet-4.6
Azure
Status
anthropic/claude-sonnet-5
Azure
Status
deepseek/deepseek-r1
Azure
Status
deepseek/deepseek-v3.1-terminus
Streamlake
Status
deepseek/deepseek-v3.2
Alibaba Cloud
Status
deepseek/deepseek-v3.2
Baidu
Status
deepseek/deepseek-v3.2
Google Vertex
Status
deepseek/deepseek-v3.2
Phala
Status
deepseek/deepseek-v3.2
Streamlake
Status
deepseek/deepseek-v4-flash-0731
Akashml
Status
deepseek/deepseek-v4-flash-0731
Baidu
Status
deepseek/deepseek-v4-flash-0731
Baseten
Status
deepseek/deepseek-v4-flash-0731
Inceptron
Status
deepseek/deepseek-v4-flash-0731
Openinference
Status
deepseek/deepseek-v4-flash-0731
Phala
Status
deepseek/deepseek-v4-flash-0731
Streamlake
Status
deepseek/deepseek-v4-flash-0731
Together
Status
deepseek/deepseek-v4-flash-0731
Wafer
Status
deepseek/deepseek-v4-flash-0731
Weights And Biases
Status
deepseek/deepseek-v4-pro
Alibaba Cloud
Status
deepseek/deepseek-v4-pro
Baidu
Status
deepseek/deepseek-v4-pro
Cloudflare
Status
deepseek/deepseek-v4-pro
Parasail
Status
deepseek/deepseek-v4-pro
Streamlake
Status
deepseek/deepseek-v4-pro-lightning
Crofai
Status
Provider listing
google/gemini-2.5-flash-image
Google Vertex
Status
z-ai/glm-4.7
Google Vertex
Status
z-ai/glm-4.7
Mancer
Status
z-ai/glm-4.7
Streamlake
Status
z-ai/glm-5
Baidu
Status
z-ai/glm-5
Streamlake
Status
z-ai/glm-5.1
Alibaba Cloud
Status
z-ai/glm-5.1
Atlascloud
Status
z-ai/glm-5.1
Baidu
Status
z-ai/glm-5.1
Nebius
Status
z-ai/glm-5.1
Novita
Status
z-ai/glm-5.1
Parasail
Status
z-ai/glm-5.1
Phala
Status
z-ai/glm-5.1
Streamlake
Status
z-ai/glm-5.2
Baidu
Status
z-ai/glm-5.2
Streamlake
Status
openai/gpt-3.5-turbo-0613
Azure
Status
openai/gpt-3.5-turbo-16k
Azure
Status
openai/gpt-4
Azure
Status
openai/gpt-4.1
Azure
Status
openai/gpt-4.1-mini
Azure
Status
openai/gpt-4.1-nano
Azure
Status
openai/gpt-4o
Azure
Status
openai/gpt-4o-2024-05-13
Azure
Status
openai/gpt-4o-2024-08-06
Azure
Status
openai/gpt-4o-mini
Azure
Status
openai/gpt-5
Azure
Status
openai/gpt-5-mini
Azure
Status
openai/gpt-5.1
Azure
Status
openai/gpt-5.1-codex
Azure
Status
openai/gpt-5.1-codex-max
Azure
Status
openai/gpt-5.1-codex-mini
Azure
Status
openai/gpt-5.2
Azure
Status
openai/gpt-5.2-chat
Azure
Status
openai/gpt-5.2-codex
Azure
Status
openai/gpt-5.3-codex
Azure
Status
openai/gpt-5.4
Azure
Status
openai/gpt-5.4-mini
Azure
Status
openai/gpt-5.4-nano
Azure
Status
openai/gpt-5.4-pro
Azure
Status
openai/gpt-5.5
Azure
Status
openai/gpt-5.6-luna
Azure
Status
openai/gpt-5.6-luna-pro
Azure
Status
openai/gpt-5.6-sol
Azure
Status
openai/gpt-5.6-sol-pro
Azure
Status
openai/gpt-5.6-terra
Azure
Status
openai/gpt-5.6-terra-pro
Azure
Status
openai/gpt-oss-120b
Google Vertex
Status
openai/gpt-oss-120b
Mancer
Status
openai/gpt-oss-120b
Parasail
Status
openai/gpt-oss-120b
Phala
Status
openai/gpt-oss-20b
Google Vertex
Status
openai/gpt-oss-20b
Parasail
Status
openai/gpt-oss-20b
Phala
Status
tencent/hy3
Baidu
Status
thinking-machines/inkling-64k
Thinking Machines
Status
Provider listing
kwaipilot/kat-coder-pro-v2
Streamlake
Status
moonshotai/kimi-k2-thinking
Google Vertex
Status
moonshotai/kimi-k2.5
Phala
Status
moonshotai/kimi-k2.5
Streamlake
Status
moonshotai/kimi-k2.6
Baidu
Status
moonshotai/kimi-k2.6
Parasail
Status
moonshotai/kimi-k2.6
Phala
Status
moonshotai/kimi-k2.6
Streamlake
Status
moonshotai/kimi-k2.7-code
Alibaba Cloud
Status
meituan/longcat-2.0
Atlascloud
Status
xiaomi/mimo-v2.5
Deepinfra
Status
xiaomi/mimo-v2.5
Gmicloud
Status
xiaomi/mimo-v2.5
Parasail
Status
xiaomi/mimo-v2.5-pro
Atlascloud
Status
xiaomi/mimo-v2.5-pro
Deepinfra
Status
xiaomi/mimo-v2.5-pro
Gmicloud
Status
xiaomi/mimo-v2.5-pro
Streamlake
Status
minimax/minimax-m2
Google Vertex
Status
minimax/minimax-m2.5
Inceptron
Status
minimax/minimax-m2.5
Streamlake
Status
minimax/minimax-m2.7
Groq
Status
minimax/minimax-m3
Deepinfra
Status
minimax/minimax-m3
Parasail
Status
mistral/mistral-nemo
Deepinfra
Status
mistral/mistral-nemo
Io Net
Status
mistral/mistral-nemo
Parasail
Status
meta/muse-glimmer-30b
Deepinfra
Status
meta/muse-glimmer-30b
Fireworks
Status
allenai/olmo-3-32b-think
Parasail
Status
qwen/qwen3-235b-a22b
Alibaba Cloud
Status
qwen/qwen3-235b-a22b-2507
Google Vertex
Status
qwen/qwen3-235b-a22b-2507
Nebius
Status
qwen/qwen3-235b-a22b-2507
Parasail
Status
qwen/qwen3-235b-a22b-2507
Streamlake
Status
qwen/qwen3-30b-a3b
Alibaba Cloud
Status
qwen/qwen3-30b-a3b-instruct-2507
Streamlake
Status
qwen/qwen3-30b-a3b-instruct-2507
Weights And Biases
Status
qwen/qwen3-coder
Alibaba Cloud
Status
qwen/qwen3-coder
Deepinfra
Status
qwen/qwen3-coder
Google Vertex
Status
qwen/qwen3-coder
Novita
Status
qwen/qwen3-coder
Venice
Status
qwen/qwen3-coder-next
Parasail
Status
qwen/qwen3-coder-next
Streamlake
Status
qwen/qwen3-max
Alibaba Cloud
Status
qwen/qwen3-max-thinking
Alibaba Cloud
Status
qwen/qwen3-next-80b-a3b-instruct
Google Vertex
Status
qwen/qwen3-next-80b-a3b-instruct
Novita
Status
qwen/qwen3-next-80b-a3b-instruct
Parasail
Status
qwen/qwen3-next-80b-a3b-thinking
Google Vertex
Status
qwen/qwen3-vl-235b-a22b-instruct
Novita
Status
qwen/qwen3-vl-235b-a22b-instruct
Parasail
Status
qwen/qwen3-vl-235b-a22b-instruct
Venice
Status
qwen/qwen3-vl-30b-a3b-instruct
Alibaba Cloud
Status
qwen/qwen3-vl-30b-a3b-instruct
Novita
Status
qwen/qwen3-vl-30b-a3b-thinking
Alibaba Cloud
Status
qwen/qwen3-vl-32b-instruct
Alibaba Cloud
Status
qwen/qwen3-vl-8b-instruct
Alibaba Cloud
Status
qwen/qwen3-vl-8b-instruct
Parasail
Status
qwen/qwen3-vl-8b-thinking
Alibaba Cloud
Status
qwen/qwen3.5-27b
Phala
Status
qwen/qwen3.5-35b-a3b
Parasail
Status
qwen/qwen3.5-397b-a17b
Parasail
Status
qwen/qwen3.5-397b-a17b
Phala
Status
qwen/qwen3.5-397b-a17b
Streamlake
Status
qwen/qwen3.5-9b
Parasail
Status
qwen/qwen3.6-27b
Io Net
Status
qwen/qwen3.6-27b
Phala
Status
qwen/qwen3.6-35b-a3b
Atlascloud
Status
qwen/qwen3.6-35b-a3b
Io Net
Status
qwen/qwen3.6-35b-a3b
Parasail
Status
qwen/qwen3.6-35b-a3b
Phala
Status
arcee-ai/trinity-large-thinking
Parasail
Status
anthropic/claude-opus-4.7-fast
Anthropic
Status
deepseek/deepseek-v4-pro-lightning
Deepseek
Status
thinking-machines/inkling-64k
Thinking Machines
Status
windsurf/swe-1.6-fast
Windsurf
Status
anthropic/claude-opus-4.7
Kilo
Priority
Priority
Priority
Priority
anthropic/claude-opus-4.7
Openrouter
Priority
Priority
Priority
Priority
anthropic/claude-opus-4.7
Venice
Priority
Priority
Priority
Priority
deepseek/deepseek-v4-pro
Crofai
Priority
Priority
Priority
Priority
Priority
Priority
z-ai/glm-5.2
Crofai
Standard • Priority 120
Standard • Priority 120
Standard • Priority 120
thinking-machines/inkling
Thinking Machines
64K
64K • Priority 200
64K
64K • Priority 200
64K
64K • Priority 200
moonshotai/kimi-k2.5
Crofai
Priority
Priority
Priority
openai/gpt-5.6-sol
Openrouter
Standard
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
openai/gpt-5.6-sol-pro
Openrouter
Standard
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
lightricks/ltx-2-fast
Lightricks
Status
lightricks/ltx-2-pro
Lightricks
Status
lightricks/ltx-2.3-fast
Lightricks
Status
lightricks/ltx-2.3-pro
Lightricks
Status
lightricks/ltx-2.5-fast
Lightricks
Status
lightricks/ltx-2.5-pro
Lightricks
Status
mistral/codestral
Mistral
Batch
Batch
mistral/codestral-embed
Mistral
Batch
mistral/devstral-2
Mistral
Batch
Batch
mistral/devstral-medium-1.0
Mistral
Batch
Batch
mistral/devstral-small-1.1
Mistral
Batch
Batch
mistral/devstral-small-2
Mistral
Batch
Batch
mistral/magistral-medium-1.2
Mistral
Batch
Batch
mistral/magistral-small-1.2
Mistral
Batch
Batch
mistral/ministral-3-14b
Mistral
Batch
Batch
mistral/ministral-3-3b
Mistral
Batch
Batch
Batch
Batch
mistral/ministral-3-8b
Mistral
Batch
Batch
mistral/mistral-embed
Mistral
Batch
mistral/mistral-large-2.1
Mistral
Batch
Batch
mistral/mistral-large-3
Mistral
Batch
Batch
mistral/mistral-medium-3.0
Mistral
Batch
Batch
mistral/mistral-medium-3.1
Mistral
Batch
Batch
mistral/mistral-medium-3.5
Mistral
Batch
Batch
mistral/mistral-nemo-12b
Mistral
Batch
Batch
mistral/mistral-small-3.2
Mistral
Batch
Batch
mistral/mistral-small-4
Mistral
Priority
Priority
mistral/mistral-small-creative
Mistral
Batch
Batch
mistral/pixtral-large
Mistral
Batch
Batch
mistral/voxtral-mini
Mistral
Batch
mistral/voxtral-small
Mistral
Batch
Batch
Batch
openai/gpt-5.6-luna
OpenAI
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
openai/gpt-5.6-luna-pro
OpenAI
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
openai/gpt-5.6-sol
OpenAI
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
openai/gpt-5.6-sol-pro
OpenAI
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
openai/gpt-5.6-terra
OpenAI
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
openai/gpt-5.6-terra-pro
OpenAI
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
Standard • Input Tokens < 272000
Standard • Input Tokens <= 272000
Standard • Input Tokens > 272000
Standard • Input Tokens >= 272000
z-ai/glm-5.2
Mistral
Batch
Batch
Batch
microsoft/mai-code-1-flash
Microsoft
Deprecation date
Status
Description
MAI Code 1 Flash is Microsoft's inference-efficient agentic coding model, tailored for GitHub Copilot, VS Code, and Microsoft developer workflows. This entry tracks the Build 2026 launch announcement.
MAI Code 1 Flash is Microsoft's inference-efficient agentic coding model, tailored for GitHub Copilot and Microsoft developer workflows.
microsoft/mai-code-1.1-flash
Microsoft
Status