Find the models that fit your workload by capability, task economics, speed, context, and provider availability.
164 results · sorted by intelligence
| # | Details | ||||||||
|---|---|---|---|---|---|---|---|---|---|
| 1 | Claude Opus 5Anthropic | 63.1 | 78 | 59.2 | $0.425 | 14s | 1.0M | 3 | |
| 2 | Claude Fable 5Anthropic | 62.1 | 76.5 | 56.6 | $3.14 | 2.6 min | 1.0M | 3 | |
| 3 | GPT-5.6 SolOpenAI | 60.9 | 77.4 | 57.8 | $0.237 | 9.7s | 1.0M | 2 | |
| 4 | Grok 4.6 (high)SpaceXAI | 60.9 | 76.8 | 58.7 | $0.837 | 46s | 500K | 1 | |
| 5 | Kimi K3OpenKimi | 59.7 | 76.2 | 54.3 | $0.838 | 69s | 1.0M | 11 | |
| 6 | GLM-5.3OpenZ AI | 59.5 | 74.8 | 59.1 | $0.683 | 31s | 1.0M | 1 | |
| 7 | GPT-5.6 Sol (xhigh)OpenAI | 59 | 78.3 | 53.6 | $0.807 | 59s | 1.0M | 1 | |
| 8 | Qwen3.8 MaxOpenAlibaba | 58.1 | 71.8 | 58.4 | $1.13 | 59s | 1.0M | 1 | |
| 9 | Qwen3.8 2.4T A95BOpenAlibaba | 57.7 | 71.9 | 57.1 | $1.09 | 57s | 984K | 6 | |
| 10 | GPT-5.6 Sol (high)OpenAI | 57.3 | 77.2 | 50.6 | $0.548 | 24s | 1.0M | 1 | |
| 11 | GPT-5.6 TerraOpenAI | 56.6 | 76.7 | 50.2 | $0.102 | 5.9s | 1.0M | 2 | |
| 12 | Gemini 3.7 Flash (high)Google | 56 | 76.1 | 45.1 | $0.402 | 17s | 1.0M | 1 | |
| 13 | Grok 4.5 (high)SpaceXAI | 55.8 | 72.4 | 48.9 | $0.360 | 24s | 500K | 1 | |
| 14 | GPT-5.6 Sol (medium)OpenAI | 55.6 | 76.3 | 47.9 | $0.372 | 13s | 1.0M | 1 | |
| 15 | Claude Sonnet 5Anthropic | 55.3 | 71.5 | 49.7 | $0.417 | 10s | 1.0M | 4 | |
| 16 | Gemini 3.7 Flash (medium)Google | 53.4 | 71.5 | 45.1 | $0.263 | 6.2s | 1.0M | 1 | |
| 17 | DeepSeek V4 Pro 0813OpenDeepSeek | 53.2 | 68.8 | 49.6 | $0.252 | 35s | 1.0M | 8 | |
| 18 | GPT-5.6 Terra (xhigh)OpenAI | 52.8 | 70.6 | 46.5 | $0.305 | 32s | 1.0M | 1 | |
| 19 | GLM-5.2OpenZ AI | 52.6 | 68.8 | 45.7 | $0.445 | 5.7s | 1.0M | 18 | |
| 20 | GPT-5.6 LunaOpenAI | 52.3 | 71.4 | 46.9 | $0.012 | 4.2s | 1.0M | 2 | |
| 21 | Qwen3.8 27BOpenAlibaba | 52 | 68.1 | 50.9 | N/A | N/A | 262K | 1 | |
| 22 | DeepSeek V4 Flash 0731OpenDeepSeek | 51.8 | 69.1 | 48.4 | $0.112 | 25s | 1.0M | 14 | |
| 23 | Gemini 3.6 Flash (high)Google | 51.6 | 69.2 | 40.5 | $0.344 | 21s | 1.0M | 1 | |
| 24 | Gemini 3.7 Flash (low)Google | 50.9 | 71 | 41.6 | $0.165 | 2.5s | 1.0M | 1 | |
| 25 | GPT-5.6 Sol (low)OpenAI | 50.7 | 69.7 | 41.6 | $0.231 | 12s | 1.0M | 1 | |
| 26 | GPT-5.6 Terra (high)OpenAI | 50.1 | 67.1 | 43.5 | $0.218 | 7.6s | 1.0M | 1 | |
| 27 | GPT-5.6 Luna (xhigh)OpenAI | 50.1 | 68.6 | 44.4 | $0.032 | 49s | 1.0M | 1 | |
| 28 | Kimi K3 (low)OpenKimi | 48.3 | 72 | 39.6 | $0.242 | 72s | 1.0M | 1 | |
| 29 | Gemini 3.1 Pro PreviewGoogle | 47.7 | 68.8 | 23 | $0.335 | 37s | 1.0M | 2 | |
| 30 | GPT-5.6 Luna (high)OpenAI | 47 | 63.3 | 41 | $0.022 | 15s | 1.0M | 1 | |
| 31 | GPT-5.6 Terra (medium)OpenAI | 46.8 | 64.7 | 39.1 | $0.119 | 7.1s | 1.0M | 1 | |
| 32 | Gemini 3.5 Flash (medium)Google | 46.7 | N/A | N/A | N/A | 23s | 1.0M | 1 | |
| 33 | GPT-5.3 Codex (xhigh)OpenAI | 45.5 | N/A | N/A | N/A | 79s | 400K | 1 | |
| 34 | MiniMax-M3OpenMiniMax | 45.4 | 58.6 | 36.1 | $0.139 | 29s | 1.0M | 10 | |
| 35 | DeepSeek V4 ProOpenDeepSeek | 45.3 | 59.4 | 37.8 | $0.043 | 8.4s | 1.0M | 9 | |
| 36 | Kimi K2.6OpenKimi | 45.1 | 61.8 | 31.2 | $0.365 | 15s | 262K | 1 | |
| 37 | Kimi K2.7 CodeOpenKimi | 43 | 60.8 | 30.3 | $0.222 | 76s | 262K | 9 | |
| 38 | MiMo-V2.5-ProOpenXiaomi | 42.9 | 60.2 | 29.5 | $0.034 | 12s | 1.0M | 3 | |
| 39 | Inkling (xhigh)OpenThinking Machines | 42.3 | 52.1 | 34.1 | $0.339 | 36s | 524K | 4 | |
| 40 | Hy3OpenTencent | 42.2 | 58.8 | 31.4 | $0.036 | 40s | 262K | 4 | |
| 41 | Nex-N2-ProOpenNex AGI | 41.7 | 59.1 | 31.2 | N/A | 20s | 262K | 1 | |
| 42 | Solar Pro 4Upstage | 41.6 | 52.7 | 33.6 | $0.223 | 56s | 512K | 1 | |
| 43 | GPT-5.6 Terra (low)OpenAI | 41.3 | 58.1 | 31.5 | $0.094 | 6.9s | 1.0M | 1 | |
| 44 | Inkling SmallOpenThinking Machines | 41.2 | 52.9 | 31.9 | $0.073 | 39s | 524K | 3 | |
| 45 | GLM-5.1 (Reasoning)OpenZ AI | 41 | 55.8 | 30.6 | $0.304 | 53s | 200K | 1 | |
| 46 | Agnes 2.5 Pro AlphaSapiens AI | 39.7 | 58.8 | 25.4 | N/A | 21s | 1.0M | 1 | |
| 47 | Qwen3.7 PlusOpenAlibaba | 39.4 | 55.9 | 20.7 | $0.242 | 46s | 1.0M | 1 | |
| 48 | GPT-5.6 Luna (medium)OpenAI | 38.9 | 50.7 | 31.8 | $0.011 | 6.4s | 1.0M | 1 | |
| 49 | Nemotron 3 Ultra 550B A55B (Reasoning)OpenNVIDIA | 38.3 | 49.3 | 27.5 | $0.383 | 23s | 512K | 4 | |
| 50 | MiMo-V2.5OpenXiaomi | 38 | 56.8 | 24.4 | $0.010 | 48s | 1.0M | 4 | |
| 51 | Ling 3.0 FlashOpenInclusionAI | 37.8 | 50.6 | 29.3 | $0.038 | N/A | 131K | 1 | |
| 52 | Qwen3.6 27B (Reasoning)OpenAlibaba | 37.7 | 53.7 | 27.5 | $0.292 | 1.9 min | 262K | 6 | |
| 53 | Gemini 3.5 Flash-LiteGoogle | 37.4 | 49.3 | 27.2 | $0.097 | 11s | 1.0M | 1 | |
| 54 | Grok 4.3 (medium)SpaceXAI | 36.9 | N/A | N/A | N/A | 18s | 1.0M | 3 | |
| 55 | GLM-5.1OpenZ AI | 36.3 | N/A | N/A | N/A | 9.8s | 200K | 1 | |
| 56 | Grok 4.3 (low)SpaceXAI | 36.3 | N/A | N/A | N/A | 12s | 1.0M | 3 | |
| 57 | Gemini 3.5 FlashGoogle | 35.8 | N/A | N/A | N/A | 4.1s | 1.0M | 1 | |
| 58 | Muse Glimmer (high)OpenMeta | 35.1 | 49 | 22.9 | $0.073 | 23s | 131K | 2 | |
| 59 | Claude Sonnet 4.6Anthropic | 35.1 | N/A | N/A | N/A | 13s | 1.0M | 1 | |
| 60 | MiniMax-M2.5OpenMiniMax | 34.5 | N/A | N/A | N/A | 28s | 196K | 1 | |
| 61 | Qwen3.5 397B A17B (Reasoning)OpenAlibaba | 34.3 | 48.2 | 19.8 | $0.357 | 44s | 262K | 8 | |
| 62 | LongCat 2.0OpenLongCat | 34 | 45.3 | 22 | $0.121 | 66s | 1.0M | 1 | |
| 63 | GPT-5.6 Luna (low)OpenAI | 33.9 | 44.2 | 25.7 | $0.0088 | 5.4s | 1.0M | 1 | |
| 64 | KAT Coder Pro V2KwaiKAT | 33.7 | 59.5 | 15.1 | N/A | 6.0s | 256K | 1 | |
| 65 | Qwen3.5 122B A10B (Reasoning)OpenAlibaba | 32.8 | 45.7 | 21.3 | $0.253 | 22s | 262K | 4 | |
| 66 | Qwen3.5 397B A17BOpenAlibaba | 32.7 | N/A | N/A | N/A | 8.1s | 262K | 6 | |
| 67 | Qwen3.6 35B A3B (Reasoning)OpenAlibaba | 32.1 | 41.9 | 21.6 | $0.294 | 52s | 262K | 6 | |
| 68 | Qwen3.5 Omni PlusOpenAlibaba | 31.3 | N/A | N/A | N/A | 13s | 256K | 1 | |
| 69 | Qwen3.6 27BOpenAlibaba | 31.3 | 46.6 | 23.6 | $0.398 | 13s | 262K | 4 | |
| 70 | o3OpenAI | 31.1 | N/A | N/A | N/A | 13s | 200K | 2 | |
| 71 | Step 3.7 FlashOpenStepFun | 30.9 | 39.6 | 21.7 | $0.091 | 24s | 256K | 2 | |
| 72 | Mistral Medium 3.5OpenMistral | 30.4 | 46.9 | 19.2 | $0.464 | 21s | 262K | 1 | |
| 73 | Claude 4.5 Haiku (Reasoning)Anthropic | 29.9 | 43.9 | 16.5 | $0.217 | 22s | 200K | 4 | |
| 74 | Gemma 4 31B (Reasoning)OpenGoogle | 29.7 | 43.4 | 14.4 | $0.0000 | 63s | 262K | 12 | |
| 75 | DeepSeek V4 FlashOpenDeepSeek | 29.3 | N/A | N/A | N/A | N/A | 1.0M | 2 | |
| 76 | GPT-5.5 InstantOpenAI | 29.2 | 39.4 | 11.1 | $0.536 | 22s | 400K | 1 | |
| 77 | Qwen3.5 122B A10BOpenAlibaba | 28.2 | 43.3 | 16.2 | $0.195 | 5.8s | 262K | 2 | |
| 78 | Gemma 4 26B A4B (Reasoning)OpenGoogle | 26.1 | 39.3 | 11 | $0.039 | N/A | 1.0M | 5 | |
| 79 | Nemotron 3 Super 120B A12B (Reasoning)OpenNVIDIA | 25.7 | 37.7 | 8.8 | $0.229 | 21s | 262K | 3 | |
| 80 | Grok 4.3SpaceXAI | 25 | 35.2 | 23 | $0.295 | 6.0s | 1.0M | 2 | |
| 81 | Qwen3.6 35B A3BOpenAlibaba | 24.6 | 28.1 | 19.2 | $0.630 | 5.8s | 262K | 5 | |
| 82 | Ling 3.0 TinyOpenInclusionAI | 24.5 | 26.5 | 16 | $0.0000 | 18s | 262K | 1 | |
| 83 | Qwen3.5 35B A3BOpenAlibaba | 24.3 | 37 | 11.8 | $0.241 | 5.1s | 262K | 2 | |
| 84 | Claude 4.5 HaikuAnthropic | 24.1 | N/A | N/A | N/A | 6.6s | 200K | 4 | |
| 85 | gpt-oss-120b (high)OpenOpenAI | 24.1 | 30.4 | 13.4 | $0.073 | 16s | 131K | 14 | |
| 86 | Nemotron 3.5 LightningOpenNVIDIA | 23.6 | 26.8 | 13.8 | $0.076 | 9.4s | 1.0M | 6 | |
| 87 | Command A+OpenCohere | 22.8 | 27.8 | 9.2 | $0.0000 | 12s | 200K | 1 | |
| 88 | Gemma 4 31BOpenGoogle | 22.3 | 33.2 | 11.1 | $0.044 | 7.5s | 262K | 9 | |
| 89 | Gemma 4 12B (Reasoning)OpenGoogle | 22.2 | 31 | N/A | N/A | 25s | 262K | 1 | |
| 90 | Nova 2.0 Pro Preview (medium)Amazon | 22.1 | 34 | N/A | N/A | 35s | 256K | 1 | |
| 91 | Mercury 2Inception | 21.9 | 31.1 | 9.5 | $0.080 | 4.5s | 128K | 1 | |
| 92 | Qwen3.5 9B (Reasoning)OpenAlibaba | 21.8 | 28.7 | 7 | $0.242 | 33s | 262K | 2 | |
| 93 | Qwen3 Coder NextOpenAlibaba | 21.3 | 36.2 | 8.9 | $0.337 | 5.0s | 262K | 3 | |
| 94 | Nova 2.0 Lite (high)Amazon | 20.8 | 23 | N/A | N/A | 29s | 1.0M | 1 | |
| 95 | Qwen3.5 9BOpenAlibaba | 20.6 | 23.5 | N/A | N/A | 6.6s | 262K | 1 | |
| 96 | Qwen3.5 4B (Reasoning)OpenAlibaba | 20.4 | 22.6 | N/A | N/A | 84s | 262K | 1 | |
| 97 | Gemma 4 26B A4BOpenGoogle | 20.4 | N/A | N/A | N/A | 7.8s | 1.0M | 6 | |
| 98 | North Mini CodeOpenCohere | 20.2 | 36.5 | 3.1 | $0.0000 | 1.6 min | 256K | 1 | |
| 99 | Nova 2.0 Pro Preview (low)Amazon | 19.8 | 25.9 | N/A | N/A | 32s | 256K | 1 | |
| 100 | Mistral Small 4 (Reasoning)OpenMistral | 19.7 | 26.6 | 4.6 | $0.100 | 16s | 256K | 1 | |
| 101 | Devstral 2OpenMistral | 19.2 | 31.3 | 10.6 | $0.0000 | 15s | 262K | 1 | |
| 102 | Qwen3.5 Omni FlashOpenAlibaba | 19.2 | N/A | N/A | N/A | 3.9s | 256K | 1 | |
| 103 | Nova 2.0 Lite (medium)Amazon | 19.2 | N/A | N/A | N/A | 35s | 1.0M | 1 | |
| 104 | Trinity Large ThinkingOpenArcee AI | 18.7 | 25.8 | 3.7 | $0.164 | 14s | 262K | 2 | |
| 105 | Qwen3 235B A22B 2507 InstructOpenAlibaba | 18.4 | N/A | N/A | N/A | 11s | 262K | 1 | |
| 106 | Nova 2.0 Lite (low)Amazon | 18 | N/A | N/A | N/A | 23s | 1.0M | 1 | |
| 107 | Magistral Medium 1.2OpenMistral | 18 | 21.3 | 1.9 | $0.892 | 22s | 131K | 1 | |
| 108 | Devstral Small 2OpenMistral | 17.7 | 29.3 | 10.8 | $0.0000 | 6.0s | 256K | 1 | |
| 109 | Qwen3 Next 80B A3B (Reasoning)OpenAlibaba | 16.9 | 17.4 | 2.1 | $0.042 | 15s | 262K | 3 | |
| 110 | Qwen3.5 4BOpenAlibaba | 16.1 | 20.3 | N/A | N/A | 18s | 262K | 1 | |
| 111 | Mistral Large 3OpenMistral | 15.9 | 20.1 | 5.5 | $0.081 | 12s | 262K | 3 | |
| 112 | gpt-oss-20b (high)OpenOpenAI | 15.2 | 20.7 | 3.1 | $0.025 | 19s | 131K | 7 | |
| 113 | Nemotron 3 Nano Omni 30B A3B ReasoningOpenNVIDIA | 15 | 13.8 | N/A | N/A | 8.8s | 66K | 1 | |
| 114 | gpt-oss-120b (low)OpenOpenAI | 14.9 | 21.2 | 1 | $0.020 | 16s | 131K | 12 | |
| 115 | NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)OpenNVIDIA | 14.5 | 14.4 | 2 | $0.025 | 12s | 262K | 3 | |
| 116 | Llama 4 MaverickOpenMeta | 14.5 | 16.3 | 1.2 | $0.036 | 5.4s | 1.0M | 5 | |
| 117 | Solar Pro 3Upstage | 14.5 | 16.2 | 2.9 | $0.146 | 19s | 131K | 1 | |
| 118 | gpt-oss-20b (low)OpenOpenAI | 14.4 | N/A | N/A | N/A | 16s | 131K | 6 | |
| 119 | Nova 2.0 Pro PreviewAmazon | 14.4 | 20.9 | N/A | N/A | 6.2s | 256K | 1 | |
| 120 | Qwen3 Next 80B A3B InstructOpenAlibaba | 13.8 | N/A | N/A | N/A | 4.9s | 262K | 6 |
Frontier models often cluster tightly on raw intelligence. Cost per task, response time, provider coverage, and context length usually create the real shortlist.
Use Explore to find the shape of the market, then move into Compare or use the Agentic Fit Finder when task-level reliability and cost matter more than chat quality alone.
Claude Opus 5 leads the overall quality ranking right now. The best model for you depends on your use case — coding, cost, speed, and context length all shift the answer.
Sort by Quality Index for overall strength, then filter by price, speed, or context window to match your constraints. Move to the Compare page to put 2–4 finalists head to head.
Open-weight models like DeepSeek, Qwen, and Llama often lead on quality-to-price. For agentic workflows, cost per task is usually a better filter than token price alone.
Data is pulled from Artificial Analysis and refreshed automatically. New models appear as soon as they have benchmark scores and provider endpoints.
Model rankings
Browse the latest ranking pages for overall models, coding, local hardware, open source, Ollama, long context, and agentic workflows.
Current coding leaderboard using LiveCodeBench, Terminal-Bench, and SciCode.
Top open-weight models for self-hosting, Ollama, and low-cost API use.
Best local AI models by hardware tier for self-hosting on Macs, RTX GPUs, and workstations.
Coding-focused local models mapped to 8GB, 24GB, 64GB, and server-class hardware.
Ollama-first picks for coding, chat, reasoning, and low-friction local inference.
Best long-context models for large documents, codebases, and retrieval-heavy workflows.
Rankings for tool use, multi-step execution, and autonomous agent workflows.