LLM head-to-head comparisons

325 comparisons across the 26 highest-scoring models. Only models with published benchmarks and pricing get a comparison page — an auto-paired table of two models nobody measured is noise.

Last rebuild: August 3, 2026

Claude Opus 5 index 60.7 · $25.00/1M out · 1M Claude Fable 5 index 59.9 · $50.00/1M out · 1M GPT-5.6 Sol index 58.9 · $30.00/1M out · 1.1M Kimi K3 index 57.1 · $15.00/1M out · 1.0M Claude Opus 4.8 index 55.7 · $25.00/1M out · 1M GPT-5.6 Terra index 55.0 · $7.50/1M out · 1.1M GPT-5.5 index 54.8 · $30.00/1M out · 1.1M Grok 4.5 index 53.8 · $6.00/1M out · 500K

Claude Opus 5 compared

Claude Fable 5 compared

GPT-5.6 Sol compared

Kimi K3 compared

Claude Opus 4.8 compared

GPT-5.6 Terra compared

GPT-5.5 compared

Grok 4.5 compared

Claude Opus 4.7 compared

Claude Sonnet 5 compared

GPT-5.4 compared

GPT-5.6 Luna compared

GLM 5.2 compared

Muse Spark 1.1 compared

Gemini 3.5 Flash compared

Gemini 3.6 Flash compared

Claude Sonnet 4.6 compared

Gemini 3.1 Pro Preview compared

Qwen3.7 Max compared

MiniMax M3 compared

DeepSeek V4 Pro compared

Kimi K2.6 compared

MiMo-V2.5-Pro compared

Kimi K2.7 Code compared

Hy3 preview compared

Nex-N2-Pro compared