Models / OpenAI / GPT 5.6 Terra Prices as of 2026-07-14 · rev 179affb · unknown is shown as unknown, never $0.00
Compare GPT 5.6 Terra Strongest at Reasoning · Mathematics top-quartile among comparable models scored on these domains
Value position 95th pctile GPQA 3 cheaper models match or beat it on GPQA — see the value chart
Data confidence 4/4 exact benchmarks measured on this exact model · prices 2026-07-14
Cost / request $0.01 1K in · 500 out
Input / M $2.50
Output / M $15.00
Cache read / M $0.25
Context 1.1M 1,050,000 tokens
Max output 128K 128,000 tokens
Capability fingerprint independent benchmarks, grouped by domain · higher is better · not our measurement Reasoning
GPQA Diamondgraduate-level science reasoning
91% 95th pctile
exact model optimized run Epoch evaluations · GPT-5.6 Terra
SimpleBencheveryday reasoning (unsaturated)
39% 62nd pctile
exact model SimpleBench Leaderboard · GPT-5.6 Terra
Mathematics
AIME (OTIS mock)olympiad math
100% 98th pctile
exact model optimized run Epoch evaluations · GPT-5.6 Terra
Factuality
SimpleQAfactual accuracy (higher = fewer hallucinations)
43% 57th pctile
exact model Epoch evaluations · GPT-5.6 Terra
peer median · percentile ranks this model among distinct comparable models (deduped — one entry per model, not per provider) scored on that benchmark · exact model / family proxy per row.
Source: Epoch AI — “AI Benchmarking Hub” (epoch.ai ), CC-BY (Epoch AI). Some rows carry an upstream leaderboard (shown per row); Aider & Terminal-Bench are additionally Apache-2.0. Each benchmark measures a different thing on a different scale — rows are not comparable across domains, and a score is not a guarantee of quality on your task.
Capabilities Index Epoch AI's cross-model capability re-fit · one comparable axis · not our measurement 158.2 ECI
97th percentile of 150 models exact model
84.0 111.4 138.7 166.1 Epoch Capabilities Index (relative re-fit scale) peer median 139.7 : 158.2 (95% CI 155.6–161.3) 158.2
The dot is GPT 5.6 Terra ; the whisker is its 95% CI; the firm tick is the peer median; faint ticks are every other scored model. Unlike a raw benchmark, the ECI axis is comparable across models — but it's a relative re-fit scale, so a model's exact position can shift when Epoch recomputes it.
Source: Epoch AI — Capabilities Index & Notable-Models data (epoch.ai ), CC-BY (Epoch AI). The ECI is Epoch's index, not TokenTriage's; per-fact confidence labels are Epoch's own.
Cost vs quality where GPT 5.6 Terra sits among GPQA-scored models cheaper & higher-scoring 0% 25% 50% 75% 100% $0.00001 $0.0001 $0.001 $0.01 $0.1 $1 $10 $100 $1K Cost per request · 1K in / 500 out (log) GPQA Diamond Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3 Opus — 30% GPQA · $0.0525/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Opus 4.8 — 88% GPQA · $0.0175/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Claude Sonnet 5 — 87% GPQA · $0.007/req Llama 2 70b Chat HF — 2% GPQA · $0.0015/req Meta Llama 3 70B Instruct — 21% GPQA · $0.0015/req Meta Llama 3 8B Instruct — 1% GPQA · $0.000225/req Mixtral 8x7B Instruct — 7% GPQA · $0.000225/req GPT 4o — 32% GPQA · $0.00825/req GPT 4o — 31% GPQA · $0.00825/req GPT 4o Mini — 17% GPQA · $0.000495/req GPT 5 — 82% GPQA · $0.006875/req GPT 5 Mini — 67% GPQA · $0.001375/req GPT 5 Nano — 59% GPQA · $0.000275/req GPT 5.1 — 84% GPQA · $0.00688/req GPT 5.4 — 91% GPQA · $0.011/req GPT 5.4 — 91% GPQA · $0.011/req GPT 5.5 — 92% GPQA · $0.022/req GPT 5.5 — 92% GPQA · $0.022/req GPT 5.6 Luna — 89% GPQA · $0.0044/req GPT 5.6 Sol — 91% GPQA · $0.022/req GPT 5.6 Terra — 91% GPQA · $0.011/req O1 — 69% GPQA · $0.0495/req O1 Mini — 50% GPQA · $0.00363/req O1 Preview — 34% GPQA · $0.0495/req O3 Mini — 69% GPQA · $0.00363/req GPT 4o — 32% GPQA · $0.0075/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 4o — 32% GPQA · $0.0075/req GPT 4o — 31% GPQA · $0.0075/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 3.5 Turbo — 4% GPQA · $0.00125/req GPT 3.5 Turbo 0125 — 3% GPQA · $0.00125/req GPT 35 Turbo — 4% GPQA · $0.00125/req GPT 35 Turbo 0125 — 3% GPQA · $0.00125/req GPT 35 Turbo 1106 — 4% GPQA · $0.002/req GPT 4 — 8% GPQA · $0.06/req GPT 4.0125 Preview — 8% GPQA · $0.025/req GPT 4.0613 — 8% GPQA · $0.06/req GPT 4.1106 Preview — 8% GPQA · $0.025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4.5 Preview — 58% GPQA · $0.15/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o — 32% GPQA · $0.0125/req GPT 4o — 32% GPQA · $0.0075/req GPT 4o — 31% GPQA · $0.00825/req GPT 4o Mini — 17% GPQA · $0.000495/req GPT 4o Mini — 17% GPQA · $0.000495/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.2 — 89% GPQA · $0.00875/req GPT 5.2 — 89% GPQA · $0.00875/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.6 Luna — 89% GPQA · $0.004/req GPT 5.6 Sol — 91% GPQA · $0.02/req GPT 5.6 Terra — 91% GPQA · $0.01/req Mistral Large 2402 — 18% GPQA · $0.02/req Mistral Large Latest — 35% GPQA · $0.02/req O1 — 69% GPQA · $0.045/req O1 — 69% GPQA · $0.045/req O1 Mini — 50% GPQA · $0.00363/req O1 Mini — 50% GPQA · $0.0033/req O1 Preview — 69% GPQA · $0.045/req O1 Preview — 34% GPQA · $0.045/req O3 — 76% GPQA · $0.006/req O3 — 76% GPQA · $0.006/req O3 Mini — 69% GPQA · $0.0033/req O3 Mini — 69% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req GPT 4.1 — 56% GPQA · $0.0066/req GPT 4.1 Mini — 54% GPQA · $0.00132/req GPT 4.1 Nano — 32% GPQA · $0.00033/req GPT 4o — 32% GPQA · $0.00825/req GPT 4o — 31% GPQA · $0.00825/req GPT 4o Mini — 17% GPQA · $0.000495/req GPT 5 — 82% GPQA · $0.006875/req GPT 5 Mini — 67% GPQA · $0.001375/req GPT 5 Nano — 59% GPQA · $0.000275/req GPT 5.1 — 84% GPQA · $0.00688/req GPT 5.4 — 91% GPQA · $0.011/req GPT 5.4 — 91% GPQA · $0.011/req GPT 5.5 — 92% GPQA · $0.022/req GPT 5.5 — 92% GPQA · $0.022/req GPT 5.6 Luna — 89% GPQA · $0.0044/req GPT 5.6 Sol — 91% GPQA · $0.022/req GPT 5.6 Terra — 91% GPQA · $0.011/req O1 — 69% GPQA · $0.0495/req O1 Mini — 50% GPQA · $0.00363/req O1 Preview — 34% GPQA · $0.0495/req O3 — 76% GPQA · $0.0066/req O3 Mini — 69% GPQA · $0.00363/req O4 Mini — 73% GPQA · $0.00363/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Opus 4.8 — 88% GPQA · $0.0175/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Claude Sonnet 5 — 87% GPQA · $0.007/req Deepseek R1 — 62% GPQA · $0.00405/req Deepseek — 42% GPQA · $0.00342/req Deepseek v3 0324 — 57% GPQA · $0.00342/req Deepseek V4 Pro — 86% GPQA · $0.00348/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.5 — 92% GPQA · $0.02/req GPT Oss 120b — 68% GPQA · $0.00045/req Grok 4 — 83% GPQA · $0.0105/req Kimi K2.6 — 88% GPQA · $0.00295/req Llama 3.2 90B Vision Instruct — 21% GPQA · $0.00306/req Llama 3.3 70B Instruct — 30% GPQA · $0.001065/req Llama 4 Maverick 17B 128E Instruct Fp8 — 56% GPQA · $0.001585/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.00059/req Meta Llama 3 70B Instruct — 21% GPQA · $0.001285/req Mistral Large — 35% GPQA · $0.01/req Mistral Large 2407 — 32% GPQA · $0.005/req Mistral Large Latest — 35% GPQA · $0.005/req Mistral Medium 2505 — 46% GPQA · $0.0014/req Mistral Small — 30% GPQA · $0.0025/req Mistral Small 2503 — 30% GPQA · $0.00025/req Phi 3 Medium 128k Instruct — 3% GPQA · $0.00051/req Phi 4 — 41% GPQA · $0.000375/req GPT 3.5 Turbo Instruct 0914 — 4% GPQA · $0.0025/req GPT 35 Turbo Instruct — 4% GPQA · $0.0025/req GPT 35 Turbo Instruct 0914 — 4% GPQA · $0.0025/req Deepseek v3 0324 — 57% GPQA · $0.001155/req GPT Oss 120b — 68% GPQA · $0.00035/req Glm 4.7 — 78% GPQA · $0.0017/req Glm 5 — 84% GPQA · $0.002525/req GPT Oss 120b — 68% GPQA · $0.000725/req Llama 3.3 70b — 30% GPQA · $0.00145/req Llama3.1 70b — 26% GPQA · $0.0009/req Llama3.1 8b — 1% GPQA · $0.00015/req Llama 4 Scout 17b 16e Instruct — 36% GPQA · $0.000695/req Kimi K2.6 — 88% GPQA · $0.00295/req Kimi K2.7 Code — 86% GPQA · $0.00295/req GPT Oss 120b — 68% GPQA · $0.000725/req Glm 5.2 — 89% GPQA · $0.0036/req Deepseek R1 0528 — 68% GPQA · $0.0065/req Deepseek v3 0324 — 57% GPQA · $0.00225/req Llama 3.3 70B Instruct — 30% GPQA · $0.0003/req GPT Oss 120b — 68% GPQA · $0.0012/req Qwen Max — 41% GPQA · $0.0048/req Claude 3.7 Sonnet Latest — 73% GPQA · $0.01155/req Deepseek R1 — 62% GPQA · $0.0019/req Deepseek R1 0528 — 68% GPQA · $0.001575/req Deepseek — 42% GPQA · $0.000825/req Deepseek v3 0324 — 57% GPQA · $0.00069/req Gemini 2.0 Flash 001 — 52% GPQA · $0.0003/req Gemini 2.5 Pro — 80% GPQA · $0.00625/req Gemma 3 27b It — 32% GPQA · $0.00017/req Llama 3.3 70B Instruct — 30% GPQA · $0.00043/req Llama 4 Maverick 17B 128E Instruct Fp8 — 56% GPQA · $0.00045/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.00023/req Meta Llama 3 8B Instruct — 1% GPQA · $0.00006/req Phi 4 — 41% GPQA · $0.00014/req Mixtral 8x7B Instruct — 7% GPQA · $0.0006/req GPT Oss 120b — 68% GPQA · $0.000275/req Qwen2.5 72B Instruct — 32% GPQA · $0.000315/req Qwen3 235B A22b — 61% GPQA · $0.00045/req Qwen3 235B A22b Thinking 2507 — 73% GPQA · $0.00175/req Deepseek Reasoner — 78% GPQA · $0.00049/req Deepseek V4 Pro — 86% GPQA · $0.00087/req Deepseek R1 — 62% GPQA · $0.001645/req Deepseek Reasoner — 78% GPQA · $0.00049/req Deepseek — 42% GPQA · $0.00082/req Deepseek V4 Pro — 86% GPQA · $0.00087/req Deepseek R1 — 62% GPQA · $0.007/req Deepseek R1 0528 — 68% GPQA · $0.007/req Deepseek — 42% GPQA · $0.00135/req Deepseek v3 0324 — 57% GPQA · $0.00135/req Deepseek V4 Pro — 86% GPQA · $0.00348/req Gemma 3 27b It — 32% GPQA · $0.00135/req Gemma2 9b It — 3% GPQA · $0.0003/req GPT Oss 120b — 68% GPQA · $0.00045/req Kimi K2p5 — 83% GPQA · $0.0021/req Qwen2 72b Instruct — 21% GPQA · $0.00135/req Qwen3 235b A22b — 61% GPQA · $0.00066/req Qwen3 235b A22b Thinking 2507 — 73% GPQA · $0.00066/req Yi 34b Chat — 0% GPQA · $0.00135/req Deepseek V4 Pro — 86% GPQA · $0.00348/req GPT Oss 120b — 68% GPQA · $0.00045/req Kimi K2p5 — 83% GPQA · $0.0021/req Gemini 2.0 Flash 001 — 52% GPQA · $0.0003/req Gemini 2.5 Pro — 80% GPQA · $0.00625/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req Gemini 3.1 Pro Preview — 92% GPQA · $0.008/req Gemini 3.5 Flash — 90% GPQA · $0.006/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Deepseek v3 0324 — 57% GPQA · $0.00072/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 5 — 82% GPQA · $0.00625/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.2 — 89% GPQA · $0.00875/req Llama3.3 70b Instruct — 30% GPQA · $0.000975/req Llama 4 Scout 17b 16e Instruct — 36% GPQA · $0.00028/req GPT Oss 120b — 68% GPQA · $0.00045/req Deepseek R1 — 62% GPQA · $0.0006/req Deepseek R1 0528 — 68% GPQA · $0.000375/req Deepseek — 42% GPQA · $0.0003/req Deepseek v3 0324 — 57% GPQA · $0.0006/req Llama 3.3 70B Instruct — 30% GPQA · $0.00027/req Meta Llama 3 70B Instruct — 21% GPQA · $0.00027/req Qwen2.5 72B Instruct — 32% GPQA · $0.00027/req Qwen3 235B A22b — 61% GPQA · $0.003/req Deepseek R1 0528 — 68% GPQA · $0.0005/req Deepseek v3 0324 — 57% GPQA · $0.0005/req Llama 4 Maverick 17b 128e Instruct Fp8 — 56% GPQA · $0.0001/req Llama 4 Scout 17b 16e Instruct — 36% GPQA · $0.0001/req Llama3.1 8b Instruct — 1% GPQA · $0.000045/req Llama 3.1 8b — 1% GPQA · $0.000055/req Magistral Small 2506 — 31% GPQA · $0.00125/req Magistral Small Latest — 31% GPQA · $0.00125/req Mistral Large 2402 — 18% GPQA · $0.01/req Mistral Large 2407 — 32% GPQA · $0.0075/req Mistral Large 2411 — 35% GPQA · $0.005/req Mistral Large 2512 — 35% GPQA · $0.00125/req Mistral Large Latest — 35% GPQA · $0.00125/req Mistral Medium — 46% GPQA · $0.00675/req Mistral Medium 2312 — 46% GPQA · $0.00675/req Mistral Medium 2505 — 46% GPQA · $0.0014/req Mistral Medium 2508 — 46% GPQA · $0.0014/req Mistral Medium 2604 — 46% GPQA · $0.00525/req Mistral Medium Latest — 46% GPQA · $0.00525/req Mistral Small — 30% GPQA · $0.00025/req Mistral Small Latest — 30% GPQA · $0.00015/req Open Mistral Nemo — 7% GPQA · $0.00045/req Open Mistral Nemo 2407 — 7% GPQA · $0.00045/req Open Mixtral 8x22b — 12% GPQA · $0.005/req Kimi K2 Thinking Turbo — 79% GPQA · $0.00515/req Kimi K2.6 — 88% GPQA · $0.00295/req Deepseek R1 — 62% GPQA · $0.002/req Deepseek R1 0528 — 68% GPQA · $0.002/req Deepseek — 42% GPQA · $0.00125/req Deepseek v3 0324 — 57% GPQA · $0.00125/req Gemma 3 27b It — 32% GPQA · $0.00016/req Llama 3.3 70B Instruct — 30% GPQA · $0.00033/req Qwen2.5 72B Instruct — 32% GPQA · $0.00033/req Qwen3 235B A22b — 61% GPQA · $0.0005/req Deepseek R1 0528 — 68% GPQA · $0.00195/req Deepseek v3 0324 — 57% GPQA · $0.00083/req Gemma 3 27b It — 32% GPQA · $0.000219/req Llama 3.1 8b Instruct — 1% GPQA · $0.000045/req Llama 3.3 70b Instruct — 30% GPQA · $0.000335/req Llama 4 Maverick 17b 128e Instruct Fp8 — 56% GPQA · $0.000695/req Llama 4 Scout 17b 16e Instruct — 36% GPQA · $0.000475/req GPT Oss 120b — 68% GPQA · $0.000175/req Qwen 2.5 72b Instruct — 32% GPQA · $0.00058/req Qwen3 235b A22b Thinking 2507 — 73% GPQA · $0.0018/req Qwen3 Max — 63% GPQA · $0.006335/req Glm 4.7 — 78% GPQA · $0.0017/req Llama 3.1 8B Instruct — 1% GPQA · $0.000045/req Llama 3.3 70B Instruct — 30% GPQA · $0.0003/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.000235/req GPT 3.5 Turbo — 4% GPQA · $0.00125/req GPT 3.5 Turbo 0125 — 3% GPQA · $0.00125/req GPT 3.5 Turbo 1106 — 4% GPQA · $0.002/req GPT 4 — 8% GPQA · $0.06/req GPT 4.0125 Preview — 8% GPQA · $0.025/req GPT 4.0314 — 14% GPQA · $0.06/req GPT 4.0613 — 8% GPQA · $0.06/req GPT 4.1106 Preview — 8% GPQA · $0.025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4 Turbo Preview — 29% GPQA · $0.025/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o — 32% GPQA · $0.0125/req GPT 4o — 32% GPQA · $0.0075/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.2 — 89% GPQA · $0.00875/req GPT 5.2 — 89% GPQA · $0.00875/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.6 Luna — 89% GPQA · $0.004/req GPT 5.6 Sol — 91% GPQA · $0.02/req O1 — 69% GPQA · $0.045/req O1 — 69% GPQA · $0.045/req O3 — 76% GPQA · $0.006/req O3 — 76% GPQA · $0.006/req O3 Mini — 69% GPQA · $0.0033/req O3 Mini — 69% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Deepseek R1 — 62% GPQA · $0.001645/req Deepseek R1 0528 — 68% GPQA · $0.001575/req Gemini 2.0 Flash 001 — 52% GPQA · $0.0003/req Gemini 2.5 Pro — 80% GPQA · $0.00625/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req Gemini 3.1 Pro Preview — 92% GPQA · $0.008/req Mistral Large — 35% GPQA · $0.02/req Mistral Large 2512 — 35% GPQA · $0.00125/req GPT 3.5 Turbo — 4% GPQA · $0.0025/req GPT 4 — 8% GPQA · $0.06/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o — 32% GPQA · $0.0125/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5.2 — 89% GPQA · $0.00875/req GPT Oss 120b — 68% GPQA · $0.00058/req O1 — 69% GPQA · $0.045/req O3 Mini — 69% GPQA · $0.0033/req Qwen3 235b A22b 2507 — 61% GPQA · $0.000121/req Qwen3 235b A22b Thinking 2507 — 73% GPQA · $0.00041/req Qwen3.5 Flash 02.23 — 78% GPQA · $0.0003/req Qwen3.5 Plus 02.15 — 79% GPQA · $0.0016/req Qwen3.6 Plus — 83% GPQA · $0.0013/req Grok 4 — 83% GPQA · $0.0105/req Glm 4.7 — 78% GPQA · $0.00115/req Glm 5 — 84% GPQA · $0.00208/req Glm 5.1 — 81% GPQA · $0.0028/req GPT Oss 120b — 68% GPQA · $0.00028/req Llama 3.1 8B Instruct — 1% GPQA · $0.00015/req Mixtral 8x7B Instruct — 7% GPQA · $0.000945/req Llama 3.1 70b Instruct — 26% GPQA · $0.0015/req Llama 3.1 8b Instruct — 1% GPQA · $0.0003/req Claude 3.5 Haiku — 18% GPQA · $0.0035/req Claude 3.5 Sonnet — 40% GPQA · $0.013125/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Deepseek R1 — 62% GPQA · $0.00875/req Deepseek — 42% GPQA · $0.002175/req Gemini 3 Pro — 90% GPQA · $0.008/req Mixtral 8x7b Instruct — 7% GPQA · $0.0008/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT Oss 120b — 68% GPQA · $0.00054/req O1 — 69% GPQA · $0.045/req O1 Mini — 50% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.003/req Grok 4 — 83% GPQA · $0.0252/req Deepseek R1 — 62% GPQA · $0.0085/req Deepseek v3 0324 — 57% GPQA · $0.00525/req GPT Oss 120b — 68% GPQA · $0.000515/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.00075/req Gemma 3 27b It — 32% GPQA · $0.0005/req Llama 3.3 70b Instruct — 30% GPQA · $0.00135/req GPT Oss 120b — 68% GPQA · $0.00045/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Deepseek R1 — 62% GPQA · $0.00405/req Llama3.1 405b — 35% GPQA · $0.0018/req Llama3.1 70b — 26% GPQA · $0.00108/req Llama3.1 8b — 1% GPQA · $0.00036/req Llama3.3 70b — 30% GPQA · $0.00108/req Deepseek V4 Pro — 86% GPQA · $0.00087/req Kimi K2.6 — 88% GPQA · $0.00296/req GPT Oss 120b — 68% GPQA · $0.00045/req GPT 3.5 Turbo Instruct — 4% GPQA · $0.0025/req GPT 3.5 Turbo Instruct 0914 — 4% GPQA · $0.0025/req Deepseek R1 — 62% GPQA · $0.0065/req Deepseek — 42% GPQA · $0.001875/req Llama 4 Maverick 17B 128E Instruct Fp8 — 56% GPQA · $0.000695/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.000475/req Mixtral 8x7B Instruct — 7% GPQA · $0.0009/req GPT Oss 120b — 68% GPQA · $0.00045/req Qwen3 235B A22b Thinking 2507 — 73% GPQA · $0.00215/req Glm 4.7 — 78% GPQA · $0.00145/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3 Opus — 30% GPQA · $0.0525/req Claude 3.5 Haiku — 18% GPQA · $0.0028/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Deepseek R1 — 62% GPQA · $0.001645/req Deepseek — 42% GPQA · $0.00135/req Gemini 2.5 Pro — 80% GPQA · $0.0075/req Gemma 2 9b — 3% GPQA · $0.0003/req Llama 3.1 70b — 26% GPQA · $0.00108/req Llama 3.1 8b — 1% GPQA · $0.00009/req Llama 3.3 70b — 30% GPQA · $0.00108/req Magistral Small — 31% GPQA · $0.00125/req Mistral Large — 35% GPQA · $0.005/req Mistral Small — 30% GPQA · $0.00025/req GPT 3.5 Turbo — 4% GPQA · $0.00125/req GPT 3.5 Turbo Instruct — 4% GPQA · $0.0025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req O1 — 69% GPQA · $0.045/req O3 — 76% GPQA · $0.006/req O3 Mini — 69% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req Grok 2 — 38% GPQA · $0.007/req Grok 4 — 83% GPQA · $0.0105/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req Gemini 3.1 Pro Preview — 92% GPQA · $0.008/req Gemini 3.5 Flash — 90% GPQA · $0.006/req Claude 3.5 Haiku — 18% GPQA · $0.0035/req Claude 3.5 Haiku — 18% GPQA · $0.0035/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.5 Sonnet — 39% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3 Opus — 30% GPQA · $0.0525/req Claude 3 Opus — 30% GPQA · $0.0525/req Claude 3 Sonnet — 21% GPQA · $0.0105/req Claude 3 Sonnet — 21% GPQA · $0.0105/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Opus 4.8 — 88% GPQA · $0.0175/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 5 — 87% GPQA · $0.007/req Gemini 2.0 Flash 001 — 52% GPQA · $0.00045/req Gemini 2.5 Pro — 80% GPQA · $0.00625/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req Gemini 3.1 Pro Preview — 92% GPQA · $0.008/req Gemini 3.5 Flash — 90% GPQA · $0.006/req Mistral Large 2411 — 35% GPQA · $0.005/req Mistral Large — 32% GPQA · $0.005/req Mistral Small 2503 — 30% GPQA · $0.0025/req Deepseek R1 0528 — 68% GPQA · $405.00/req Deepseek v3 0324 — 57% GPQA · $251.50/req Llama 3.1 8B Instruct — 1% GPQA · $33.00/req Llama 3.3 70B Instruct — 30% GPQA · $106.50/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $50.00/req GPT Oss 120b — 68% GPQA · $45.00/req Qwen3 235B A22b Thinking 2507 — 73% GPQA · $15.00/req Llama 3.2 90b Vision Instruct — 21% GPQA · $0.003/req Llama 3.3 70b Instruct — 30% GPQA · $0.001065/req Mistral Large — 35% GPQA · $0.008/req Mistral Medium 2505 — 46% GPQA · $0.008/req Mistral Small 2503 — 30% GPQA · $0.00025/req GPT Oss 120b — 68% GPQA · $0.00045/req Grok 2 — 38% GPQA · $0.007/req Grok 2.1212 — 38% GPQA · $0.007/req Grok 2 Latest — 38% GPQA · $0.007/req Grok 3 Beta — 68% GPQA · $0.0105/req Grok 3 Latest — 68% GPQA · $0.0105/req Grok 3 Mini Beta — 68% GPQA · $0.00055/req Grok 3 Mini Latest — 68% GPQA · $0.00055/req Grok 4 — 83% GPQA · $0.0105/req Grok 4.0709 — 83% GPQA · $0.0105/req Grok 4 Latest — 83% GPQA · $0.0105/req Grok 4.20.0309 Reasoning — 86% GPQA · $0.005/req Grok 4.3 — 85% GPQA · $0.0025/req Grok 4.3 Latest — 85% GPQA · $0.0025/req Grok 4.5 — 91% GPQA · $0.005/req Grok 4.5 Latest — 91% GPQA · $0.005/req Glm 4.7 — 78% GPQA · $0.0017/req Glm 5 — 84% GPQA · $0.0026/req Glm 5.1 — 81% GPQA · $0.0036/req GPT 5.6 Terra — 91% GPQA at $0.01/req GPT 5.6 Terra Each dot is a model with a GPQA Diamond score, priced at a 1K-in / 500-out request; GPT 5.6 Terra is highlighted. The shaded corner holds models that are both cheaper and higher-scoring; the dashed staircase is the value frontier. Hover any dot for its model.
3 cheaper models match or beat GPT 5.6 Terra on GPQA— see the full table below , switchable by benchmark.
Also worth considering cheaper models that score about as well — pick the benchmark that matters to you GPQA Diamond SimpleBench AIME (OTIS mock) SimpleQA
8 cheaper models score within 3 points of GPT 5.6 Terra on GPQA Diamond .
Pricing Input · fresh prompt tokens $2.50 / M✓ 3 sources agree Output · generated tokens $15.00 / M✓ 3 sources agree Cache read · cached-input hit $0.25 / M Cache write · 5-minute TTL $3.13 / M Reasoning · thinking tokens unknown Batch input · async 50% tier $1.25 / M Batch output · async 50% tier $7.50 / M
Context-length tiers
Base (≤ 272K) $2.50 / $15.00 per M Above 272K $5.00 / $22.50 per M
When total input exceeds the threshold, the tier rate applies to the whole request.
$5.68 $4.26 $2.84 $1.42 $0 0 263K 525K 788K 1.1M Total input tokens Cost / request the whole request reprices at 272K tokens (+99%) whole request reprices +99% at 272K rates as of 2026-07-14 · rev 179affb Cross the 272K line by a single token and the whole request reprices — every token, not just those above the line. Assumes 500 output tokens (the cliff's position depends on input alone). Snapshot rates; providers do change tier structure.
Reasoning tokens: no separate rate is published. Providers typically bill thinking tokens at the output rate ($15.00 / M) — which is what the estimator assumes, so an extended-thinking workload isn't silently undercounted.
Model info
Provider OpenAI
Catalog key openai/gpt-5.6-terra
Identifier Floating alias (may re-point over time)
Type Chat
Max input 1,050,000 tokens
Max output 128,000 tokens
Released 2026-07-09
Knowledge cutoff 2026-02-16
Weights Proprietary
Price snapshot 2026-07-14 · rev 179affb Pricing from TokenTriage's resolved price artifact (TokenTriage resolved price artifact (internal/pricing/data/prices.json) ); capability + model metadata is third-party (LiteLLM model_prices_and_context_window.json, models.dev). Unknown means unstated, not absent.
Prompt-cache break-even reuse the same prefix ≥ 2 times and caching wins 0 1 2 3 4 Times the prefix is reused Cumulative cost breaks even at 2 reuses No cache With cache Writing a prefix to cache costs a premium, but each subsequent hit reads at $0.25/M instead of $2.50/M. For this model the crossover is 2 reuses — past that, the same prompt keeps getting cheaper. TokenTriage's semantic cache is built to cross that line for you.
Effective cost / 1,000 words normalised comparison metric · your headline price is per token , but tokenizers pack words differently gpt-5.6-terra uses the OpenAI o200k (GPT-4o / GPT-4.1 / o-series) tokenizer. The figures below multiply its per-token price by how many tokens that tokenizer produces for representative text — so two models at the samelist price aren't the same price per word . This is a comparison lens, not a bill:the estimator remains the authoritative cost for your own traffic.
⚠ The OpenAI o200k (GPT-4o / GPT-4.1 / o-series) tokenizer is inferred from OpenAI's current base encoding for this model — not independently confirmed. If it ships a different tokenizer, its per-word figures would shift.
Prose Code Multilingual
Among 75 models with a public tokenizer, GPT 5.6 Terra ranks 44th by list price per token and 44th by cost per 1,000 words — normalising doesn't change its position here.
Among 75 models with a public tokenizer, GPT 5.6 Terra ranks 44th by list price per token and 44th by cost per 1,000 words — normalising doesn't change its position here.
Among 75 models with a public tokenizer, GPT 5.6 Terra ranks 44th by list price per token but 43rd by cost per 1,000 words of multilingual — a more token-efficient tokenizer moves it up.
By list price / token By cost / 1K words cheapest ↑ cheapest ↑ GPT 4.1 GPT 4.1 · $0.0039/1K O3 O3 · $0.0039/1K O4 Mini Deep Resear… O4 Mini Deep Re… · $0.0039/1K Davinci 002 Davinci 002 · $0.0057/1K GPT 4o GPT 4o · $0.0049/1K GPT 5.4 GPT 5.4 · $0.0049/1K GPT 4o Audio Preview GPT 4o Audio Pr… · $0.0049/1K GPT 4o Search Previ… GPT 4o Search P… · $0.0049/1K GPT 5.6 Terra: By list price / token rank 5, By cost / 1K words rank 4 (moves up 1) GPT 5.6 Terra GPT 5.6 Terra · $0.0049/1K Lines that cross are rank flips: models whose order changes once price is measured per word, not per token. Tokens/word measured with gpt-tokenizer (MIT) over a fixed self-authored corpus (as of 2026-07-29); only derived counts are stored, no vocabulary is shipped. Word count: whitespace-delimited tokens; approximate for non-spaced scripts (CJK) in the multilingual sample.Models whose tokenizer isn't publicly reproducible (e.g. Claude, Gemini) are not comparable here and are excluded — never assigned a guessed count.
Capabilities 9 documented as supportedInput & output
✓ Vision
✓ PDF input
? Audio input
? Audio output
API behaviour
✓ Streaming
✓ Structured output
✓ Prompt caching
✓ Reasoning
Agents & tools
✓ Function calling
✓ Parallel tool calls
✓ Web search
? Computer use
✓ supported ·✕ not supported ·? not documented ·⚠ sources disagree. A models.dev tag means the LiteLLM catalog was silent and an independent source supplied the value (lower confidence); ? is never silently turned into a confident ✕.
Estimate a request disjoint token buckets · input = fresh (uncached) tokens Preset Chat turn RAG · 8K ctx Agent · 20 tools Batch summarize
Cost / request —
Projected / month —
How output length drives the bill at a 1K-token prompt · cost scales linearly with output $0.51 $0.38 $0.26 $0.13 $0 0 32K 64K 96K 128K Output tokens Cost / request max output output spend = input spend at ~167 tokens output spend overtakes input at ~167 Output tokens overtake input spend at ~167 tokens for this model — past that, generation is your bill, whatever the headline input price says. Computed by the same cost engine as the estimate above.
Route to GPT 5.6 Terra OpenAI-compatible · one base URL cURL Python
Copy curl https://YOUR-TOKENTRIAGE-HOST/v1/chat/completions \
-H "Authorization: Bearer $TOKENTRIAGE_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-5.6-terra",
"messages": [{"role": "user", "content": "Hello"}]
}'from openai import OpenAI
client = OpenAI(
base_url="https://YOUR-TOKENTRIAGE-HOST/v1",
api_key="YOUR_TOKENTRIAGE_KEY",
)
resp = client.chat.completions.create(
model="openai/gpt-5.6-terra",
messages=[{"role": "user", "content": "Hello"}],
)
print(resp.choices[0].message.content)Point your existing OpenAI client at your TokenTriage host and pass the catalog key as the model. TokenTriage attributes the real cost per request and can route to a cheaper model once it's proven just as good on your traffic.
Data & API machine-readable · rev 179affb Pull this model's pricing, capabilities, benchmarks and cross-source provenance programmatically — every field carries the snapshot rev, and unknown is null, never 0. Free to reuse with attribution: benchmarks & Capabilities Index © Epoch AI (CC-BY (Epoch AI)); human-preference Elo © LMArena (CC-BY-4.0); capability & price cross-check via models.dev v2 (MIT) · Portkey (MIT) · TrueFoundry (MIT); open-weights facts via Hugging Face (per-repo license).
A price is a guess until it meets your traffic. This page tells you what GPT 5.6 Terra charges per token. TokenTriage tells you what it costs on your real requests — and cuts the bill only after proving a cheaper model is just as good.