Quality
Highest overall scores
- 1
OpenAI: GPT-5.6 Sol58.9
- 2
OpenAI: GPT-5.6 Terra55
- 3
OpenAI: GPT-5.6 Luna51.2
Compare OpenAI models across answer quality, coding, complex tasks, speed, price, and context size.
Highest overall scores
Fastest output in this sample
Lowest price per 1M tokens
Overall capability · Higher is better
Output tokens per second · Higher is better
USD per 1M tokens · Lower is better
Quality benchmarks
Performance and price
8 models in the current catalogue.
| Model | Links | |||||
|---|---|---|---|---|---|---|
| OpenAI: GPT-5.6 Sol | 58.9 | 85 t/s | 1.1M | $5.00 | $30.00 | |
| OpenAI: GPT-5.6 Terra | 55 | — | 1.1M | $1.00 | $6.00 | |
| OpenAI: GPT-5.6 Luna | 51.2 | — | 1.1M | $0.10 | $0.60 | |
| OpenAI GPT Mini Latest | 0 | — | 400K | $0.75 | $4.50 | |
| OpenAI: GPT Chat Latest | 0 | — | 400K | $5.00 | $30.00 | |
| OpenAI: GPT-5.6 Luna Pro | 0 | 170 t/s | 1.1M | $0.10 | $0.60 | |
| OpenAI: GPT-5.6 Sol Pro | 0 | — | 1.1M | $5.00 | $30.00 | |
| OpenAI: GPT-5.6 Terra Pro | 0 | — | 1.1M | $1.00 | $6.00 |
Compare named evaluation records available for OpenAI models. Missing results remain blank rather than being estimated.
| Benchmark | Area | GPT-5.6 Sol | GPT-5.6 Terra | GPT-5.6 Luna | OpenAI GPT Mini Latest | GPT Chat Latest | GPT-5.6 Luna Pro | GPT-5.6 Sol Pro | GPT-5.6 Terra Pro | Source |
|---|---|---|---|---|---|---|---|---|---|---|
| Intelligence Index | overallQuality | 58.9 | 55 | 51.2 | — | — | — | — | — | OpenRouter / artificial-analysis |
| Coding Index | coding | 77.4 | 76.7 | 71.4 | — | — | — | — | — | OpenRouter / artificial-analysis |
| Agentic Index | agentic | 54 | 47.4 | 45.6 | — | — | — | — | — | OpenRouter / artificial-analysis |
| GPQA | GPQA Diamond | 94.1 | 92.5 | 91.1 | — | — | — | — | — | OpenRouter model benchmarks |
| Humanity's Last Exam | HLE | 47.2 | 41.8 | 37.2 | — | — | — | — | — | OpenRouter model benchmarks |
| IFBench | IFBench | 72.7 | 71.2 | — | — | — | — | — | — | OpenRouter model benchmarks |
| τ²-Bench Telecom | τ²-Bench Telecom | 85.1 | 86.3 | — | — | — | — | — | — | OpenRouter model benchmarks |
| AA-LCR | AA-LCR | 73.7 | 74 | 74 | — | — | — | — | — | OpenRouter model benchmarks |
| GDPval-AA | GDPval-AA | 61.8 | 54.1 | 54.1 | — | — | — | — | — | OpenRouter model benchmarks |
| CritPt | CritPt | 32.3 | 30 | 20.6 | — | — | — | — | — | OpenRouter model benchmarks |
| SciCode | SciCode | 56.1 | 53.9 | 52.5 | — | — | — | — | — | OpenRouter model benchmarks |
| Terminal-Bench Hard | Terminal-Bench Hard | 65.9 | 57.6 | — | — | — | — | — | — | OpenRouter model benchmarks |
| AA-Omniscience Accuracy | AA-Omniscience Accuracy | 58.5 | 45.9 | 41.5 | — | — | — | — | — | OpenRouter model benchmarks |
| AA-Omniscience Non-Hallucination Rate | AA-Omniscience Non-Hallucination Rate | 11.2 | 14.8 | 9.9 | — | — | — | — | — | OpenRouter model benchmarks |
| Model | Quality | Evidence | Price /1k images | Links |
|---|---|---|---|---|
| GPT Image 2 | 1340 Elo | 21,398 samples | $211 | View details |
| GPT Image 1 | — | — | — | View details |
| GPT Image 1 Mini | — | — | — | View details |
| GPT-5 Image | — | — | — | View details |
| GPT-5 Image Mini | — | — | — | View details |
| GPT-5.4 Image 2 | — | — | — | View details |
| Model | Quality | Text to video | Image to video | Links |
|---|---|---|---|---|
| Sora 2 Pro | — | — | — | View details |