Models / OpenRouter / Glm 5 Prices as of 2026-07-14 · rev 179affb · unknown is shown as unknown, never $0.00
Compare Glm 5 Strongest at Reasoning top-quartile among comparable models scored on these domains
Value position 83rd pctile GPQA 1 cheaper model matches or beat it on GPQA — see the value chart
Data confidence 7/7 exact benchmarks measured on this exact model · prices 2026-07-14
Cost / request $0.00208 1K in · 500 out
Input / M $0.80
Output / M $2.56
Context 203K 202,752 tokens
Max output 128K 128,000 tokens
Capability fingerprint independent benchmarks, grouped by domain · higher is better · not our measurement Reasoning
GPQA Diamondgraduate-level science reasoning
84% 83rd pctile
exact model optimized run Epoch evaluations · GLM-5
SimpleBencheveryday reasoning (unsaturated)
44% 64th pctile
exact model SimpleBench Leaderboard · GLM-5
Mathematics
AIME (OTIS mock)olympiad math
80% 62nd pctile
exact model optimized run Epoch evaluations · GLM-5
FrontierMathresearch-level math
29% 73rd pctile
exact model optimized run Epoch evaluations · GLM-5
Code & agentic
SWE-Bench Verifiedresolves real GitHub issues (agentic)
72% 38th pctile
exact model optimized run Epoch evaluations · GLM-5
Terminal-Benchautonomous terminal tasks (agentic)
52% 69th pctile
exact model optimized run Epoch AI evaluations · GLM-5
WeirdMLnovel out-of-distribution ML coding
48% 65th pctile
exact model WeirdML Leaderboard · GLM-5
peer median · percentile ranks this model among distinct comparable models (deduped — one entry per model, not per provider) scored on that benchmark · exact model / family proxy per row.
Source: Epoch AI — “AI Benchmarking Hub” (epoch.ai ), CC-BY (Epoch AI). Some rows carry an upstream leaderboard (shown per row); Aider & Terminal-Bench are additionally Apache-2.0. Each benchmark measures a different thing on a different scale — rows are not comparable across domains, and a score is not a guarantee of quality on your task.
Capabilities Index Epoch AI's cross-model capability re-fit · one comparable axis · not our measurement 146.4 ECI
68th percentile of 150 models exact model
84.0 111.4 138.7 166.1 Epoch Capabilities Index (relative re-fit scale) peer median 139.7 : 146.4 (95% CI 144.6–147.7) 146.4
The dot is Glm 5 ; the whisker is its 95% CI; the firm tick is the peer median; faint ticks are every other scored model. Unlike a raw benchmark, the ECI axis is comparable across models — but it's a relative re-fit scale, so a model's exact position can shift when Epoch recomputes it.
Model facts · Epoch AI, likely confidence
Developer Z.ai (Zhipu AI)
First published 2026-02-17
Parameters 744B params"GLM-5 scales to 256 experts and reduces its layer count to 80 to minimize expert parallelism communication overhead. This results in a 744B parameter model"
Training compute 6.8e24 FLOP
Access Open weights (unrestricted) Source: Epoch AI — Capabilities Index & Notable-Models data (epoch.ai ), CC-BY (Epoch AI). The ECI is Epoch's index, not TokenTriage's; per-fact confidence labels are Epoch's own.
Human preference (LMArena) blind pairwise human votes · Elo · style-controlled · not a correctness score exact model measured on glm-5 statistically tied with 9 models overall
1065 1237 1408 1580 Arena score (Elo · higher = more often preferred) Overall peer median 1357 Overall: 1457 (95% CI 1452–1461) 1457 #49 · 28K votes Coding peer median 1400 Coding: 1497 (95% CI 1490–1505) 1497 #59 · 7.2K votes Hard prompts peer median 1370 Hard prompts: 1478 (95% CI 1473–1483) 1478 #47 · 17K votes
Each dot is Glm 5's Arena score in that category; the whisker is the 95% CI; the firm tick is the peer median across distinct models; faint ticks are the field. This is human preference — which answer people pick in a blind A/B — not a correctness or capability score, and adjacent ranks routinely overlap within their intervals.
Source: LMArena (LMArena Leaderboard (lmarena.ai) — lmarena-ai/leaderboard-dataset on Hugging Face, CC BY 4.0.). Ratings are the style-controlled estimates (length/formatting confound removed), as of 2026-07-27.
Cost vs quality where Glm 5 sits among GPQA-scored models cheaper & higher-scoring 0% 25% 50% 75% 100% $0.00001 $0.0001 $0.001 $0.01 $0.1 $1 $10 $100 $1K Cost per request · 1K in / 500 out (log) GPQA Diamond Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3 Opus — 30% GPQA · $0.0525/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Opus 4.8 — 88% GPQA · $0.0175/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Claude Sonnet 5 — 87% GPQA · $0.007/req Llama 2 70b Chat HF — 2% GPQA · $0.0015/req Meta Llama 3 70B Instruct — 21% GPQA · $0.0015/req Meta Llama 3 8B Instruct — 1% GPQA · $0.000225/req Mixtral 8x7B Instruct — 7% GPQA · $0.000225/req GPT 4o — 32% GPQA · $0.00825/req GPT 4o — 31% GPQA · $0.00825/req GPT 4o Mini — 17% GPQA · $0.000495/req GPT 5 — 82% GPQA · $0.006875/req GPT 5 Mini — 67% GPQA · $0.001375/req GPT 5 Nano — 59% GPQA · $0.000275/req GPT 5.1 — 84% GPQA · $0.00688/req GPT 5.4 — 91% GPQA · $0.011/req GPT 5.4 — 91% GPQA · $0.011/req GPT 5.5 — 92% GPQA · $0.022/req GPT 5.5 — 92% GPQA · $0.022/req GPT 5.6 Luna — 89% GPQA · $0.0044/req GPT 5.6 Sol — 91% GPQA · $0.022/req GPT 5.6 Terra — 91% GPQA · $0.011/req O1 — 69% GPQA · $0.0495/req O1 Mini — 50% GPQA · $0.00363/req O1 Preview — 34% GPQA · $0.0495/req O3 Mini — 69% GPQA · $0.00363/req GPT 4o — 32% GPQA · $0.0075/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 4o — 32% GPQA · $0.0075/req GPT 4o — 31% GPQA · $0.0075/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 3.5 Turbo — 4% GPQA · $0.00125/req GPT 3.5 Turbo 0125 — 3% GPQA · $0.00125/req GPT 35 Turbo — 4% GPQA · $0.00125/req GPT 35 Turbo 0125 — 3% GPQA · $0.00125/req GPT 35 Turbo 1106 — 4% GPQA · $0.002/req GPT 4 — 8% GPQA · $0.06/req GPT 4.0125 Preview — 8% GPQA · $0.025/req GPT 4.0613 — 8% GPQA · $0.06/req GPT 4.1106 Preview — 8% GPQA · $0.025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4.5 Preview — 58% GPQA · $0.15/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o — 32% GPQA · $0.0125/req GPT 4o — 32% GPQA · $0.0075/req GPT 4o — 31% GPQA · $0.00825/req GPT 4o Mini — 17% GPQA · $0.000495/req GPT 4o Mini — 17% GPQA · $0.000495/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.2 — 89% GPQA · $0.00875/req GPT 5.2 — 89% GPQA · $0.00875/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.6 Luna — 89% GPQA · $0.004/req GPT 5.6 Sol — 91% GPQA · $0.02/req GPT 5.6 Terra — 91% GPQA · $0.01/req Mistral Large 2402 — 18% GPQA · $0.02/req Mistral Large Latest — 35% GPQA · $0.02/req O1 — 69% GPQA · $0.045/req O1 — 69% GPQA · $0.045/req O1 Mini — 50% GPQA · $0.00363/req O1 Mini — 50% GPQA · $0.0033/req O1 Preview — 69% GPQA · $0.045/req O1 Preview — 34% GPQA · $0.045/req O3 — 76% GPQA · $0.006/req O3 — 76% GPQA · $0.006/req O3 Mini — 69% GPQA · $0.0033/req O3 Mini — 69% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req GPT 4.1 — 56% GPQA · $0.0066/req GPT 4.1 Mini — 54% GPQA · $0.00132/req GPT 4.1 Nano — 32% GPQA · $0.00033/req GPT 4o — 32% GPQA · $0.00825/req GPT 4o — 31% GPQA · $0.00825/req GPT 4o Mini — 17% GPQA · $0.000495/req GPT 5 — 82% GPQA · $0.006875/req GPT 5 Mini — 67% GPQA · $0.001375/req GPT 5 Nano — 59% GPQA · $0.000275/req GPT 5.1 — 84% GPQA · $0.00688/req GPT 5.4 — 91% GPQA · $0.011/req GPT 5.4 — 91% GPQA · $0.011/req GPT 5.5 — 92% GPQA · $0.022/req GPT 5.5 — 92% GPQA · $0.022/req GPT 5.6 Luna — 89% GPQA · $0.0044/req GPT 5.6 Sol — 91% GPQA · $0.022/req GPT 5.6 Terra — 91% GPQA · $0.011/req O1 — 69% GPQA · $0.0495/req O1 Mini — 50% GPQA · $0.00363/req O1 Preview — 34% GPQA · $0.0495/req O3 — 76% GPQA · $0.0066/req O3 Mini — 69% GPQA · $0.00363/req O4 Mini — 73% GPQA · $0.00363/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Opus 4.8 — 88% GPQA · $0.0175/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Claude Sonnet 5 — 87% GPQA · $0.007/req Deepseek R1 — 62% GPQA · $0.00405/req Deepseek — 42% GPQA · $0.00342/req Deepseek v3 0324 — 57% GPQA · $0.00342/req Deepseek V4 Pro — 86% GPQA · $0.00348/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.5 — 92% GPQA · $0.02/req GPT Oss 120b — 68% GPQA · $0.00045/req Grok 4 — 83% GPQA · $0.0105/req Kimi K2.6 — 88% GPQA · $0.00295/req Llama 3.2 90B Vision Instruct — 21% GPQA · $0.00306/req Llama 3.3 70B Instruct — 30% GPQA · $0.001065/req Llama 4 Maverick 17B 128E Instruct Fp8 — 56% GPQA · $0.001585/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.00059/req Meta Llama 3 70B Instruct — 21% GPQA · $0.001285/req Mistral Large — 35% GPQA · $0.01/req Mistral Large 2407 — 32% GPQA · $0.005/req Mistral Large Latest — 35% GPQA · $0.005/req Mistral Medium 2505 — 46% GPQA · $0.0014/req Mistral Small — 30% GPQA · $0.0025/req Mistral Small 2503 — 30% GPQA · $0.00025/req Phi 3 Medium 128k Instruct — 3% GPQA · $0.00051/req Phi 4 — 41% GPQA · $0.000375/req GPT 3.5 Turbo Instruct 0914 — 4% GPQA · $0.0025/req GPT 35 Turbo Instruct — 4% GPQA · $0.0025/req GPT 35 Turbo Instruct 0914 — 4% GPQA · $0.0025/req Deepseek v3 0324 — 57% GPQA · $0.001155/req GPT Oss 120b — 68% GPQA · $0.00035/req Glm 4.7 — 78% GPQA · $0.0017/req Glm 5 — 84% GPQA · $0.002525/req GPT Oss 120b — 68% GPQA · $0.000725/req Llama 3.3 70b — 30% GPQA · $0.00145/req Llama3.1 70b — 26% GPQA · $0.0009/req Llama3.1 8b — 1% GPQA · $0.00015/req Llama 4 Scout 17b 16e Instruct — 36% GPQA · $0.000695/req Kimi K2.6 — 88% GPQA · $0.00295/req Kimi K2.7 Code — 86% GPQA · $0.00295/req GPT Oss 120b — 68% GPQA · $0.000725/req Glm 5.2 — 89% GPQA · $0.0036/req Deepseek R1 0528 — 68% GPQA · $0.0065/req Deepseek v3 0324 — 57% GPQA · $0.00225/req Llama 3.3 70B Instruct — 30% GPQA · $0.0003/req GPT Oss 120b — 68% GPQA · $0.0012/req Qwen Max — 41% GPQA · $0.0048/req Claude 3.7 Sonnet Latest — 73% GPQA · $0.01155/req Deepseek R1 — 62% GPQA · $0.0019/req Deepseek R1 0528 — 68% GPQA · $0.001575/req Deepseek — 42% GPQA · $0.000825/req Deepseek v3 0324 — 57% GPQA · $0.00069/req Gemini 2.0 Flash 001 — 52% GPQA · $0.0003/req Gemini 2.5 Pro — 80% GPQA · $0.00625/req Gemma 3 27b It — 32% GPQA · $0.00017/req Llama 3.3 70B Instruct — 30% GPQA · $0.00043/req Llama 4 Maverick 17B 128E Instruct Fp8 — 56% GPQA · $0.00045/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.00023/req Meta Llama 3 8B Instruct — 1% GPQA · $0.00006/req Phi 4 — 41% GPQA · $0.00014/req Mixtral 8x7B Instruct — 7% GPQA · $0.0006/req GPT Oss 120b — 68% GPQA · $0.000275/req Qwen2.5 72B Instruct — 32% GPQA · $0.000315/req Qwen3 235B A22b — 61% GPQA · $0.00045/req Qwen3 235B A22b Thinking 2507 — 73% GPQA · $0.00175/req Deepseek Reasoner — 78% GPQA · $0.00049/req Deepseek V4 Pro — 86% GPQA · $0.00087/req Deepseek R1 — 62% GPQA · $0.001645/req Deepseek Reasoner — 78% GPQA · $0.00049/req Deepseek — 42% GPQA · $0.00082/req Deepseek V4 Pro — 86% GPQA · $0.00087/req Deepseek R1 — 62% GPQA · $0.007/req Deepseek R1 0528 — 68% GPQA · $0.007/req Deepseek — 42% GPQA · $0.00135/req Deepseek v3 0324 — 57% GPQA · $0.00135/req Deepseek V4 Pro — 86% GPQA · $0.00348/req Gemma 3 27b It — 32% GPQA · $0.00135/req Gemma2 9b It — 3% GPQA · $0.0003/req GPT Oss 120b — 68% GPQA · $0.00045/req Kimi K2p5 — 83% GPQA · $0.0021/req Qwen2 72b Instruct — 21% GPQA · $0.00135/req Qwen3 235b A22b — 61% GPQA · $0.00066/req Qwen3 235b A22b Thinking 2507 — 73% GPQA · $0.00066/req Yi 34b Chat — 0% GPQA · $0.00135/req Deepseek V4 Pro — 86% GPQA · $0.00348/req GPT Oss 120b — 68% GPQA · $0.00045/req Kimi K2p5 — 83% GPQA · $0.0021/req Gemini 2.0 Flash 001 — 52% GPQA · $0.0003/req Gemini 2.5 Pro — 80% GPQA · $0.00625/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req Gemini 3.1 Pro Preview — 92% GPQA · $0.008/req Gemini 3.5 Flash — 90% GPQA · $0.006/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Deepseek v3 0324 — 57% GPQA · $0.00072/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 5 — 82% GPQA · $0.00625/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.2 — 89% GPQA · $0.00875/req Llama3.3 70b Instruct — 30% GPQA · $0.000975/req Llama 4 Scout 17b 16e Instruct — 36% GPQA · $0.00028/req GPT Oss 120b — 68% GPQA · $0.00045/req Deepseek R1 — 62% GPQA · $0.0006/req Deepseek R1 0528 — 68% GPQA · $0.000375/req Deepseek — 42% GPQA · $0.0003/req Deepseek v3 0324 — 57% GPQA · $0.0006/req Llama 3.3 70B Instruct — 30% GPQA · $0.00027/req Meta Llama 3 70B Instruct — 21% GPQA · $0.00027/req Qwen2.5 72B Instruct — 32% GPQA · $0.00027/req Qwen3 235B A22b — 61% GPQA · $0.003/req Deepseek R1 0528 — 68% GPQA · $0.0005/req Deepseek v3 0324 — 57% GPQA · $0.0005/req Llama 4 Maverick 17b 128e Instruct Fp8 — 56% GPQA · $0.0001/req Llama 4 Scout 17b 16e Instruct — 36% GPQA · $0.0001/req Llama3.1 8b Instruct — 1% GPQA · $0.000045/req Llama 3.1 8b — 1% GPQA · $0.000055/req Magistral Small 2506 — 31% GPQA · $0.00125/req Magistral Small Latest — 31% GPQA · $0.00125/req Mistral Large 2402 — 18% GPQA · $0.01/req Mistral Large 2407 — 32% GPQA · $0.0075/req Mistral Large 2411 — 35% GPQA · $0.005/req Mistral Large 2512 — 35% GPQA · $0.00125/req Mistral Large Latest — 35% GPQA · $0.00125/req Mistral Medium — 46% GPQA · $0.00675/req Mistral Medium 2312 — 46% GPQA · $0.00675/req Mistral Medium 2505 — 46% GPQA · $0.0014/req Mistral Medium 2508 — 46% GPQA · $0.0014/req Mistral Medium 2604 — 46% GPQA · $0.00525/req Mistral Medium Latest — 46% GPQA · $0.00525/req Mistral Small — 30% GPQA · $0.00025/req Mistral Small Latest — 30% GPQA · $0.00015/req Open Mistral Nemo — 7% GPQA · $0.00045/req Open Mistral Nemo 2407 — 7% GPQA · $0.00045/req Open Mixtral 8x22b — 12% GPQA · $0.005/req Kimi K2 Thinking Turbo — 79% GPQA · $0.00515/req Kimi K2.6 — 88% GPQA · $0.00295/req Deepseek R1 — 62% GPQA · $0.002/req Deepseek R1 0528 — 68% GPQA · $0.002/req Deepseek — 42% GPQA · $0.00125/req Deepseek v3 0324 — 57% GPQA · $0.00125/req Gemma 3 27b It — 32% GPQA · $0.00016/req Llama 3.3 70B Instruct — 30% GPQA · $0.00033/req Qwen2.5 72B Instruct — 32% GPQA · $0.00033/req Qwen3 235B A22b — 61% GPQA · $0.0005/req Deepseek R1 0528 — 68% GPQA · $0.00195/req Deepseek v3 0324 — 57% GPQA · $0.00083/req Gemma 3 27b It — 32% GPQA · $0.000219/req Llama 3.1 8b Instruct — 1% GPQA · $0.000045/req Llama 3.3 70b Instruct — 30% GPQA · $0.000335/req Llama 4 Maverick 17b 128e Instruct Fp8 — 56% GPQA · $0.000695/req Llama 4 Scout 17b 16e Instruct — 36% GPQA · $0.000475/req GPT Oss 120b — 68% GPQA · $0.000175/req Qwen 2.5 72b Instruct — 32% GPQA · $0.00058/req Qwen3 235b A22b Thinking 2507 — 73% GPQA · $0.0018/req Qwen3 Max — 63% GPQA · $0.006335/req Glm 4.7 — 78% GPQA · $0.0017/req Llama 3.1 8B Instruct — 1% GPQA · $0.000045/req Llama 3.3 70B Instruct — 30% GPQA · $0.0003/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.000235/req GPT 3.5 Turbo — 4% GPQA · $0.00125/req GPT 3.5 Turbo 0125 — 3% GPQA · $0.00125/req GPT 3.5 Turbo 1106 — 4% GPQA · $0.002/req GPT 4 — 8% GPQA · $0.06/req GPT 4.0125 Preview — 8% GPQA · $0.025/req GPT 4.0314 — 14% GPQA · $0.06/req GPT 4.0613 — 8% GPQA · $0.06/req GPT 4.1106 Preview — 8% GPQA · $0.025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4 Turbo Preview — 29% GPQA · $0.025/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o — 32% GPQA · $0.0125/req GPT 4o — 32% GPQA · $0.0075/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.2 — 89% GPQA · $0.00875/req GPT 5.2 — 89% GPQA · $0.00875/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.6 Luna — 89% GPQA · $0.004/req GPT 5.6 Sol — 91% GPQA · $0.02/req GPT 5.6 Terra — 91% GPQA · $0.01/req O1 — 69% GPQA · $0.045/req O1 — 69% GPQA · $0.045/req O3 — 76% GPQA · $0.006/req O3 — 76% GPQA · $0.006/req O3 Mini — 69% GPQA · $0.0033/req O3 Mini — 69% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Deepseek R1 — 62% GPQA · $0.001645/req Deepseek R1 0528 — 68% GPQA · $0.001575/req Gemini 2.0 Flash 001 — 52% GPQA · $0.0003/req Gemini 2.5 Pro — 80% GPQA · $0.00625/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req Gemini 3.1 Pro Preview — 92% GPQA · $0.008/req Mistral Large — 35% GPQA · $0.02/req Mistral Large 2512 — 35% GPQA · $0.00125/req GPT 3.5 Turbo — 4% GPQA · $0.0025/req GPT 4 — 8% GPQA · $0.06/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o — 32% GPQA · $0.0125/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5.2 — 89% GPQA · $0.00875/req GPT Oss 120b — 68% GPQA · $0.00058/req O1 — 69% GPQA · $0.045/req O3 Mini — 69% GPQA · $0.0033/req Qwen3 235b A22b 2507 — 61% GPQA · $0.000121/req Qwen3 235b A22b Thinking 2507 — 73% GPQA · $0.00041/req Qwen3.5 Flash 02.23 — 78% GPQA · $0.0003/req Qwen3.5 Plus 02.15 — 79% GPQA · $0.0016/req Qwen3.6 Plus — 83% GPQA · $0.0013/req Grok 4 — 83% GPQA · $0.0105/req Glm 4.7 — 78% GPQA · $0.00115/req Glm 5.1 — 81% GPQA · $0.0028/req GPT Oss 120b — 68% GPQA · $0.00028/req Llama 3.1 8B Instruct — 1% GPQA · $0.00015/req Mixtral 8x7B Instruct — 7% GPQA · $0.000945/req Llama 3.1 70b Instruct — 26% GPQA · $0.0015/req Llama 3.1 8b Instruct — 1% GPQA · $0.0003/req Claude 3.5 Haiku — 18% GPQA · $0.0035/req Claude 3.5 Sonnet — 40% GPQA · $0.013125/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Deepseek R1 — 62% GPQA · $0.00875/req Deepseek — 42% GPQA · $0.002175/req Gemini 3 Pro — 90% GPQA · $0.008/req Mixtral 8x7b Instruct — 7% GPQA · $0.0008/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT Oss 120b — 68% GPQA · $0.00054/req O1 — 69% GPQA · $0.045/req O1 Mini — 50% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.003/req Grok 4 — 83% GPQA · $0.0252/req Deepseek R1 — 62% GPQA · $0.0085/req Deepseek v3 0324 — 57% GPQA · $0.00525/req GPT Oss 120b — 68% GPQA · $0.000515/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.00075/req Gemma 3 27b It — 32% GPQA · $0.0005/req Llama 3.3 70b Instruct — 30% GPQA · $0.00135/req GPT Oss 120b — 68% GPQA · $0.00045/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Deepseek R1 — 62% GPQA · $0.00405/req Llama3.1 405b — 35% GPQA · $0.0018/req Llama3.1 70b — 26% GPQA · $0.00108/req Llama3.1 8b — 1% GPQA · $0.00036/req Llama3.3 70b — 30% GPQA · $0.00108/req Deepseek V4 Pro — 86% GPQA · $0.00087/req Kimi K2.6 — 88% GPQA · $0.00296/req GPT Oss 120b — 68% GPQA · $0.00045/req GPT 3.5 Turbo Instruct — 4% GPQA · $0.0025/req GPT 3.5 Turbo Instruct 0914 — 4% GPQA · $0.0025/req Deepseek R1 — 62% GPQA · $0.0065/req Deepseek — 42% GPQA · $0.001875/req Llama 4 Maverick 17B 128E Instruct Fp8 — 56% GPQA · $0.000695/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.000475/req Mixtral 8x7B Instruct — 7% GPQA · $0.0009/req GPT Oss 120b — 68% GPQA · $0.00045/req Qwen3 235B A22b Thinking 2507 — 73% GPQA · $0.00215/req Glm 4.7 — 78% GPQA · $0.00145/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3 Opus — 30% GPQA · $0.0525/req Claude 3.5 Haiku — 18% GPQA · $0.0028/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Deepseek R1 — 62% GPQA · $0.001645/req Deepseek — 42% GPQA · $0.00135/req Gemini 2.5 Pro — 80% GPQA · $0.0075/req Gemma 2 9b — 3% GPQA · $0.0003/req Llama 3.1 70b — 26% GPQA · $0.00108/req Llama 3.1 8b — 1% GPQA · $0.00009/req Llama 3.3 70b — 30% GPQA · $0.00108/req Magistral Small — 31% GPQA · $0.00125/req Mistral Large — 35% GPQA · $0.005/req Mistral Small — 30% GPQA · $0.00025/req GPT 3.5 Turbo — 4% GPQA · $0.00125/req GPT 3.5 Turbo Instruct — 4% GPQA · $0.0025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req O1 — 69% GPQA · $0.045/req O3 — 76% GPQA · $0.006/req O3 Mini — 69% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req Grok 2 — 38% GPQA · $0.007/req Grok 4 — 83% GPQA · $0.0105/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req Gemini 3.1 Pro Preview — 92% GPQA · $0.008/req Gemini 3.5 Flash — 90% GPQA · $0.006/req Claude 3.5 Haiku — 18% GPQA · $0.0035/req Claude 3.5 Haiku — 18% GPQA · $0.0035/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.5 Sonnet — 39% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3 Opus — 30% GPQA · $0.0525/req Claude 3 Opus — 30% GPQA · $0.0525/req Claude 3 Sonnet — 21% GPQA · $0.0105/req Claude 3 Sonnet — 21% GPQA · $0.0105/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Opus 4.8 — 88% GPQA · $0.0175/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 5 — 87% GPQA · $0.007/req Gemini 2.0 Flash 001 — 52% GPQA · $0.00045/req Gemini 2.5 Pro — 80% GPQA · $0.00625/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req Gemini 3.1 Pro Preview — 92% GPQA · $0.008/req Gemini 3.5 Flash — 90% GPQA · $0.006/req Mistral Large 2411 — 35% GPQA · $0.005/req Mistral Large — 32% GPQA · $0.005/req Mistral Small 2503 — 30% GPQA · $0.0025/req Deepseek R1 0528 — 68% GPQA · $405.00/req Deepseek v3 0324 — 57% GPQA · $251.50/req Llama 3.1 8B Instruct — 1% GPQA · $33.00/req Llama 3.3 70B Instruct — 30% GPQA · $106.50/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $50.00/req GPT Oss 120b — 68% GPQA · $45.00/req Qwen3 235B A22b Thinking 2507 — 73% GPQA · $15.00/req Llama 3.2 90b Vision Instruct — 21% GPQA · $0.003/req Llama 3.3 70b Instruct — 30% GPQA · $0.001065/req Mistral Large — 35% GPQA · $0.008/req Mistral Medium 2505 — 46% GPQA · $0.008/req Mistral Small 2503 — 30% GPQA · $0.00025/req GPT Oss 120b — 68% GPQA · $0.00045/req Grok 2 — 38% GPQA · $0.007/req Grok 2.1212 — 38% GPQA · $0.007/req Grok 2 Latest — 38% GPQA · $0.007/req Grok 3 Beta — 68% GPQA · $0.0105/req Grok 3 Latest — 68% GPQA · $0.0105/req Grok 3 Mini Beta — 68% GPQA · $0.00055/req Grok 3 Mini Latest — 68% GPQA · $0.00055/req Grok 4 — 83% GPQA · $0.0105/req Grok 4.0709 — 83% GPQA · $0.0105/req Grok 4 Latest — 83% GPQA · $0.0105/req Grok 4.20.0309 Reasoning — 86% GPQA · $0.005/req Grok 4.3 — 85% GPQA · $0.0025/req Grok 4.3 Latest — 85% GPQA · $0.0025/req Grok 4.5 — 91% GPQA · $0.005/req Grok 4.5 Latest — 91% GPQA · $0.005/req Glm 4.7 — 78% GPQA · $0.0017/req Glm 5 — 84% GPQA · $0.0026/req Glm 5.1 — 81% GPQA · $0.0036/req Glm 5 — 84% GPQA at $0.00208/req Glm 5 Each dot is a model with a GPQA Diamond score, priced at a 1K-in / 500-out request; Glm 5 is highlighted. The shaded corner holds models that are both cheaper and higher-scoring; the dashed staircase is the value frontier. Hover any dot for its model.
1 cheaper model matches or beats Glm 5 on GPQA— see the full table below , switchable by benchmark.
Also worth considering cheaper models that score about as well — pick the benchmark that matters to you GPQA Diamond SimpleBench AIME (OTIS mock) FrontierMath SWE-Bench Verified Terminal-Bench WeirdML
2 cheaper models score within 3 points of Glm 5 on GPQA Diamond .
Pricing Input · fresh prompt tokens $0.80 / M Output · generated tokens $2.56 / M Cache read · cached-input hit unknown Cache write · cache creation unknown Reasoning · thinking tokens unknown
Reasoning tokens: no separate rate is published. Providers typically bill thinking tokens at the output rate ($2.56 / M) — which is what the estimator assumes, so an extended-thinking workload isn't silently undercounted.
Model info
Provider OpenRouter
Catalog key openrouter/openrouter/z-ai/glm-5
Identifier Floating alias (may re-point over time)
Type Chat
Max input 202,752 tokens
Max output 128,000 tokens
Released 2026-02-11
Knowledge cutoff unknown
Weights Open weights
Price snapshot 2026-07-14 · rev 179affb Pricing from TokenTriage's resolved price artifact (TokenTriage resolved price artifact (internal/pricing/data/prices.json) ); capability + model metadata is third-party (LiteLLM model_prices_and_context_window.json, models.dev). Unknown means unstated, not absent.
Capabilities 2 documented as supportedInput & output
✕ Vision models.dev
? PDF input
? Audio input
? Audio output
API behaviour
? Streaming
? Structured output
? Prompt caching
✓ Reasoning
Agents & tools
✓ Function calling
? Parallel tool calls
? Web search
? Computer use
✓ supported ·✕ not supported ·? not documented ·⚠ sources disagree. A models.dev tag means the LiteLLM catalog was silent and an independent source supplied the value (lower confidence); ? is never silently turned into a confident ✕.
Open weights verified Hugging Face repo · facts from the model's safetensors index Model
Parameters 753.9B
Architecture GlmMoeDsaForCausalLM
Native precision BF16 Weights footprint
Native size 1508 GB FP16 ·native 1508 GB
FP8 754 GB
INT4 377 GB
Memory to hold the weights — not VRAM. Real serving needs extra headroom for activations and the KV cache, which grows with context length and batch size.
License & source
License mitCommercial use OK Source: Hugging Face Hub — facts read from the model repo as of 2026-07-30. Each fact carries the model's own repo license (shown above); TokenTriage neither hosts nor relicenses the weights.
Estimate a request disjoint token buckets · input = fresh (uncached) tokens Preset Chat turn RAG · 8K ctx Agent · 20 tools Batch summarize
Cost / request —
Projected / month —
How output length drives the bill at a 1K-token prompt · cost scales linearly with output $0.09 $0.07 $0.04 $0.02 $0 0 32K 64K 96K 128K Output tokens Cost / request max output output spend = input spend at ~312 tokens output spend overtakes input at ~312 Output tokens overtake input spend at ~312 tokens for this model — past that, generation is your bill, whatever the headline input price says. Computed by the same cost engine as the estimate above.
Route to Glm 5 OpenAI-compatible · one base URL cURL Python
Copy curl https://YOUR-TOKENTRIAGE-HOST/v1/chat/completions \
-H "Authorization: Bearer $TOKENTRIAGE_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openrouter/openrouter/z-ai/glm-5",
"messages": [{"role": "user", "content": "Hello"}]
}'from openai import OpenAI
client = OpenAI(
base_url="https://YOUR-TOKENTRIAGE-HOST/v1",
api_key="YOUR_TOKENTRIAGE_KEY",
)
resp = client.chat.completions.create(
model="openrouter/openrouter/z-ai/glm-5",
messages=[{"role": "user", "content": "Hello"}],
)
print(resp.choices[0].message.content)Point your existing OpenAI client at your TokenTriage host and pass the catalog key as the model. TokenTriage attributes the real cost per request and can route to a cheaper model once it's proven just as good on your traffic.
Data & API machine-readable · rev 179affb Pull this model's pricing, capabilities, benchmarks and cross-source provenance programmatically — every field carries the snapshot rev, and unknown is null, never 0. Free to reuse with attribution: benchmarks & Capabilities Index © Epoch AI (CC-BY (Epoch AI)); human-preference Elo © LMArena (CC-BY-4.0); capability & price cross-check via models.dev v2 (MIT) · Portkey (MIT) · TrueFoundry (MIT); open-weights facts via Hugging Face (per-repo license).
A price is a guess until it meets your traffic. This page tells you what Glm 5 charges per token. TokenTriage tells you what it costs on your real requests — and cuts the bill only after proving a cheaper model is just as good.