| Model | Modality | Params | Context | Description | Updated |
|---|---|---|---|---|---|
๐ง GPT-4o OpenAI | MultimodalCodingReasoning | 1.76T MoE | 128K | Flagship multimodal: text, image, audio, code + reasoning. | Aug 8, 2026 |
๐น GPT-4o mini OpenAI | TextCoding | 12B MoE | 128K | Lightweight, fast model for cost-efficient tasks. | Aug 6, 2026 |
๐งฉ o3-mini OpenAI | ReasoningCoding | Unknown | 128K | Small reasoning-first model for engineering tasks. | Aug 3, 2026 |
๐ฌ o1 Pro OpenAI | ReasoningCoding | Unknown | 200K | Deep reasoning for math, code, complex chains. | Aug 5, 2026 |
๐ฏ Claude Sonnet 4 Anthropic | MultimodalCodingText | Unknown | 200K | Balanced speed/quality Sonnet for daily work. | Aug 8, 2026 |
๐ Claude Opus 4 Anthropic | MultimodalReasoning | Unknown | 200K | Top-tier Opus for long docs, research, audit. | Aug 7, 2026 |
๐ฟ Claude Haiku 4 Anthropic | TextCoding | Unknown | 200K | Fastest Claude 4 for bulk text & RAG streaming. | Aug 4, 2026 |
โ Gemini 2.5 Pro (1M) Google DeepMind | MultimodalCoding | Unknown | 1,000K | Gemini with native 1M-token context window. | Aug 7, 2026 |
โก Gemini 2.5 Flash Google DeepMind | Multimodal | Unknown | 1,000K | Cost-optimized Flash with multimodal & agents. | Aug 6, 2026 |
๐ Gemma 3 (27B) Google | TextCoding | 27B | 128K | Open-weights Gemma with strong text/code hybrid. | Aug 2, 2026 |
๐ฆ Llama 3.3 (70B) Meta AI | TextCoding | 70B | 128K | Latest Meta OSS flagship, instruction-tuned. | Aug 6, 2026 |
๐ Llama 4 Scout Meta AI | ReasoningText | 108B+ | 128K | Meta's first reasoning-capable Llama 4 entry. | Jul 25, 2026 |
๐ Mistral Large 2 Mistral AI | TextCoding | 123B | 128K | Mistral flagship, strong multilingual code. | Jul 31, 2026 |
๐ Codestral Mamba Mistral AI | Coding | 22B | 256K | Long-window code model for file-level reasoning. | Jul 29, 2026 |
๐ญ DeepSeek-V3 DeepSeek | TextCoding | 671B MoE | 128K | Cost-competitive Mixture-of-Experts generalist. | Aug 5, 2026 |
๐งช DeepSeek-R1 DeepSeek | ReasoningCoding | 671B MoE | 128K | Open reasoning model, o1-level benchmarks. | Aug 2, 2026 |
๐ธ Qwen 3 (72B) Alibaba Cloud (Qwen) | TextCodingReasoning | 72B | 128K | Latest Qwen release with strong multilingual/math. | Jul 28, 2026 |
๐ป Qwen3 Coder (14B) Alibaba Cloud (Qwen) | Coding | 14B | 128K | Code-specialized Qwen3 variant for dev tasks. | Jul 27, 2026 |
๐ Sonar Pro Perplexity AI | ReasoningText | Unknown | 128K | Perplexity native search + reasoning LLM. | Aug 8, 2026 |
๐ Command R+ Cohere | Text | 104B | 128K | Cohere enterprise long-doc model, RAG-focused. | Jul 22, 2026 |
๐ Llama 3.1 on Groq Meta / Groq | TextCoding | 405B | 128K | 405B Llama served on Groq ultra-low latency chips. | Aug 4, 2026 |
โจ๏ธ Claude Code Model Anthropic | CodingReasoning | Unknown | 200K | Optimized for Claude Code CLI agentic coding tasks. | Aug 6, 2026 |