| Model | Modality | Params | Context | Description | Updated |
|---|---|---|---|---|---|
🧠 GPT-4o OpenAI | MultimodalCodingReasoning | 1.76T MoE | 128K | Flagship multimodal: text, image, audio, code + reasoning. | Aug 23, 2026 |
🔹 GPT-4o mini OpenAI | TextCoding | 12B MoE | 128K | Lightweight, fast model for cost-efficient tasks. | Aug 21, 2026 |
🧩 o3-mini OpenAI | ReasoningCoding | Unknown | 128K | Small reasoning-first model for engineering tasks. | Aug 18, 2026 |
🔬 o1 Pro OpenAI | ReasoningCoding | Unknown | 200K | Deep reasoning for math, code, complex chains. | Aug 20, 2026 |
🎯 Claude Sonnet 4 Anthropic | MultimodalCodingText | Unknown | 200K | Balanced speed/quality Sonnet for daily work. | Aug 23, 2026 |
💎 Claude Opus 4 Anthropic | MultimodalReasoning | Unknown | 200K | Top-tier Opus for long docs, research, audit. | Aug 22, 2026 |
🌿 Claude Haiku 4 Anthropic | TextCoding | Unknown | 200K | Fastest Claude 4 for bulk text & RAG streaming. | Aug 19, 2026 |
♊ Gemini 2.5 Pro (1M) Google DeepMind | MultimodalCoding | Unknown | 1,000K | Gemini with native 1M-token context window. | Aug 22, 2026 |
⚡ Gemini 2.5 Flash Google DeepMind | Multimodal | Unknown | 1,000K | Cost-optimized Flash with multimodal & agents. | Aug 21, 2026 |
💎 Gemma 3 (27B) Google | TextCoding | 27B | 128K | Open-weights Gemma with strong text/code hybrid. | Aug 17, 2026 |
🦙 Llama 3.3 (70B) Meta AI | TextCoding | 70B | 128K | Latest Meta OSS flagship, instruction-tuned. | Aug 21, 2026 |
🔍 Llama 4 Scout Meta AI | ReasoningText | 108B+ | 128K | Meta's first reasoning-capable Llama 4 entry. | Aug 9, 2026 |
🌀 Mistral Large 2 Mistral AI | TextCoding | 123B | 128K | Mistral flagship, strong multilingual code. | Aug 15, 2026 |
🔌 Codestral Mamba Mistral AI | Coding | 22B | 256K | Long-window code model for file-level reasoning. | Aug 13, 2026 |
🔭 DeepSeek-V3 DeepSeek | TextCoding | 671B MoE | 128K | Cost-competitive Mixture-of-Experts generalist. | Aug 20, 2026 |
🧪 DeepSeek-R1 DeepSeek | ReasoningCoding | 671B MoE | 128K | Open reasoning model, o1-level benchmarks. | Aug 17, 2026 |
🌸 Qwen 3 (72B) Alibaba Cloud (Qwen) | TextCodingReasoning | 72B | 128K | Latest Qwen release with strong multilingual/math. | Aug 12, 2026 |
💻 Qwen3 Coder (14B) Alibaba Cloud (Qwen) | Coding | 14B | 128K | Code-specialized Qwen3 variant for dev tasks. | Aug 11, 2026 |
🔍 Sonar Pro Perplexity AI | ReasoningText | Unknown | 128K | Perplexity native search + reasoning LLM. | Aug 23, 2026 |
📑 Command R+ Cohere | Text | 104B | 128K | Cohere enterprise long-doc model, RAG-focused. | Aug 6, 2026 |
🚀 Llama 3.1 on Groq Meta / Groq | TextCoding | 405B | 128K | 405B Llama served on Groq ultra-low latency chips. | Aug 19, 2026 |
⌨️ Claude Code Model Anthropic | CodingReasoning | Unknown | 200K | Optimized for Claude Code CLI agentic coding tasks. | Aug 21, 2026 |