AiCostCompare

Compare models

Pick up to 4 models for a side-by-side spec sheet. Hover any dotted metric name for what the test measures. Best value in each row is highlighted.

Claude Opus 4.6GLM 5.1
Claude Opus 4.6

Anthropic

GLM 5.1

Z.ai

Pricing
Input $/1M$5.00$0.966
Output $/1M$25.00$3.04
Blended $/1M (3:1)$10.00$1.48
Cache read $/1M$0.50$0.179
Cache write $/1M$6.25
Quality indices
Intelligence Index37.840.2
Coding Index55.8
Math Index
Agentic Index29.9
Speed & latency
Output speed (tok/s)54
Time to first token1.89s
Time to first answer token1.89s
Benchmarks (Artificial Analysis)
GPQA Diamond84.0%
Humanity's Last Exam18.6%
SciCode45.7%
IFBench44.6%
AA-LCR (Long Context Reasoning)58.3%
Terminal-Bench Hard48.5%
τ²-Bench (Telecom)84.8%
Design Arena (Elo)
Website1,3231,302
Web apps1,2611,228
Full-stack1,2791,225
Mobile apps1,2801,225
Android native1,1951,233
UI components1,3361,321
Data viz1,3221,366
SVG1,2741,267
3D1,3351,336
Game dev1,3371,328
Agentic game dev1,182
Godot game dev1,112
HTML slides1,200
PPTX slides1,241
Python→PPTX slides1,258
Agentic slides1,245
Agentic HTML slides1,205
Agentic slides (HTML)1,204
Agentic slides (Python PPTX)1,240
Code categories1,3271,311
ASCII art1,2981,182
Specs
Context window1M205K
Max output tokens128K128K
Input modalitiestext, image, filetext
TokenizerClaudeOther