OpenAI model benchmarks.

Compare OpenAI models across answer quality, coding, complex tasks, speed, price, and context size.

OpenAI

Quality

Highest overall scores

  1. 1OpenAI: GPT-5.6 Sol60.9
  2. 2OpenAI: GPT-5.6 Terra56.6
  3. 3OpenAI: GPT-5.6 Luna52.3

Response speed

Fastest output in this sample

  1. 1OpenAI: GPT-5.6 Luna139 t/s
  2. 2OpenAI: GPT-5.6 Luna Pro136 t/s
  3. 3OpenAI: GPT-5.6 Terra Pro119 t/s

Input price

Lowest price per 1M tokens

  1. 1OpenAI: GPT-5.6 Luna$0.10/1M
  2. 2OpenAI: GPT-5.6 Luna Pro$0.10/1M
  3. 3OpenAI GPT Mini Latest$0.75/1M

Highlights

Quality

Overall capability · Higher is better

Speed

Output tokens per second · Higher is better

Input price

USD per 1M tokens · Lower is better

Quality benchmarks

Compare OpenAI model capability.

Performance and price

Compare practical tradeoffs.

All OpenAI models.

8 models in the current catalogue.

OpenAI technical benchmarks.

Compare named evaluation records available for OpenAI models. Missing results remain blank rather than being estimated.

BenchmarkAreaGPT-5.6 SolGPT-5.6 TerraGPT-5.6 LunaOpenAI GPT Mini LatestGPT Chat LatestGPT-5.6 Luna ProGPT-5.6 Sol ProGPT-5.6 Terra ProSource
Intelligence IndexoverallQuality60.956.652.3—————OpenRouter / artificial-analysis
Coding Indexcoding77.476.771.4—————OpenRouter / artificial-analysis
Agentic Indexagentic57.850.246.9—————OpenRouter / artificial-analysis
GPQAGPQA Diamond94.192.591.1—————OpenRouter model benchmarks
Humanity's Last ExamHLE49.542.939.5—————OpenRouter model benchmarks
IFBenchIFBench72.771.2——————OpenRouter model benchmarks
τ²-Bench Telecomτ²-Bench Telecom85.186.3——————OpenRouter model benchmarks
AA-LCRAA-LCR77.779.778.3—————OpenRouter model benchmarks
GDPval-AAGDPval-AA61.453.954—————OpenRouter model benchmarks
CritPtCritPt32.33020.6—————OpenRouter model benchmarks
SciCodeSciCode56.153.952.5—————OpenRouter model benchmarks
Terminal-Bench HardTerminal-Bench Hard65.957.6——————OpenRouter model benchmarks
AA-Omniscience AccuracyAA-Omniscience Accuracy59.446.842.7—————OpenRouter model benchmarks
AA-Omniscience Non-Hallucination RateAA-Omniscience Non-Hallucination Rate7.812.17.4—————OpenRouter model benchmarks

OpenAI image models.

ModelQualityEvidencePrice /1k imagesLinks
GPT Image 21340 Elo21,398 samples$211View details
GPT Image 1———View details
GPT Image 1 Mini———View details
GPT-5 Image———View details
GPT-5 Image Mini———View details
GPT-5.4 Image 2———View details

OpenAI video models.

ModelQualityText to videoImage to videoLinks
Sora 2 Pro———View details