Z.ai model benchmarks.

Compare Z.ai models across answer quality, coding, complex tasks, speed, price, and context size.

Z.ai

Quality

Highest overall scores

  1. 1Z.ai: GLM 5.252.6
  2. 2Z.ai: GLM 5.141
  3. 3Z.ai: GLM 4.7 Flash0

Response speed

Fastest output in this sample

  1. 1Z.ai: GLM 5.2140 t/s
  2. 2Z.ai: GLM 5.175.5 t/s
  3. 3Z.ai: GLM 4.7 Flash53 t/s

Input price

Lowest price per 1M tokens

  1. 1Z.ai: GLM 4.7 Flash$0.06/1M
  2. 2Z.ai: GLM 5.2$0.50/1M
  3. 3Z.ai: GLM 5.1$1.40/1M

Highlights

Quality

Overall capability · Higher is better

Speed

Output tokens per second · Higher is better

Input price

USD per 1M tokens · Lower is better

Quality benchmarks

Compare Z.ai model capability.

Performance and price

Compare practical tradeoffs.

All Z.ai models.

3 models in the current catalogue.

ModelLinks
Z.ai: GLM 5.252.6140 t/s1M$0.50$3.15
Z.ai: GLM 5.14175.5 t/s204.8K$1.40$4.40
Z.ai: GLM 4.7 Flash053 t/s202.8K$0.06$0.40

Z.ai technical benchmarks.

Compare named evaluation records available for Z.ai models. Missing results remain blank rather than being estimated.

BenchmarkAreaGLM 5.2GLM 5.1GLM 4.7 FlashSource
Intelligence IndexoverallQuality52.641—OpenRouter / artificial-analysis
Coding Indexcoding68.855.8—OpenRouter / artificial-analysis
Agentic Indexagentic45.730.6—OpenRouter / artificial-analysis
GPQAGPQA Diamond89.586.875.2OpenRouter model benchmarks
Humanity's Last ExamHLE41.130.114.4OpenRouter model benchmarks
IFBenchIFBench73.376.3—OpenRouter model benchmarks
τ²-Bench Telecomτ²-Bench Telecom99.197.7—OpenRouter model benchmarks
AA-LCRAA-LCR76.768—OpenRouter model benchmarks
GDPval-AAGDPval-AA50.337.9—OpenRouter model benchmarks
CritPtCritPt20.94.6—OpenRouter model benchmarks
SciCodeSciCode50.543.8—OpenRouter model benchmarks
Terminal-Bench HardTerminal-Bench Hard50.843.2—OpenRouter model benchmarks
AA-Omniscience AccuracyAA-Omniscience Accuracy24.323.7—OpenRouter model benchmarks
AA-Omniscience Non-Hallucination RateAA-Omniscience Non-Hallucination Rate73.770.1—OpenRouter model benchmarks
SWE-bench VerifiedCoding——59.2OpenEvals/leaderboard-data