Models / OpenRouter / Qwen3.5 Flash 02.23 Prices as of 2026-07-14 · rev 179affb · unknown is shown as unknown, never $0.00
Compare Qwen3.5 Flash 02.23 Value position 73rd pctile GPQA no cheaper model matches it on GPQA
Data confidence 0/4 exact benchmarks measured on this exact model · prices 2026-07-14
Cost / request $0.0003 1K in · 500 out
Input / M $0.10
Output / M $0.40
Context 1M 1,000,000 tokens
Max output 66K 65,536 tokens
Capability fingerprint independent benchmarks, grouped by domain · higher is better · not our measurement Reasoning
GPQA Diamondgraduate-level science reasoning
78% 73rd pctile
family proxy optimized run Epoch evaluations · Qwen 3.5 Flash (hosted 35B-A3B)
Mathematics
AIME (OTIS mock)olympiad math
86% 71st pctile
family proxy optimized run Epoch evaluations · Qwen 3.5 Flash (hosted 35B-A3B)
FrontierMathresearch-level math
11% 67th pctile
family proxy optimized run Epoch evaluations · Qwen 3.5 Flash (hosted 35B-A3B)
Factuality
SimpleQAfactual accuracy (higher = fewer hallucinations)
20% 10th pctile
family proxy Epoch evaluations · Qwen 3.5 Flash (hosted 35B-A3B)
peer median · percentile ranks this model among distinct comparable models (deduped — one entry per model, not per provider) scored on that benchmark · exact model / family proxy per row.
Source: Epoch AI — “AI Benchmarking Hub” (epoch.ai ), CC-BY (Epoch AI). Some rows carry an upstream leaderboard (shown per row); Aider & Terminal-Bench are additionally Apache-2.0. Each benchmark measures a different thing on a different scale — rows are not comparable across domains, and a score is not a guarantee of quality on your task.
Human preference (LMArena) blind pairwise human votes · Elo · style-controlled · not a correctness score exact model measured on qwen3.5-flash statistically tied with 13 models overall
1065 1237 1408 1580 Arena score (Elo · higher = more often preferred) Overall peer median 1357 Overall: 1397 (95% CI 1393–1401) 1397 #136 · 58K votes Coding peer median 1400 Coding: 1437 (95% CI 1432–1443) 1437 #140 · 17K votes Hard prompts peer median 1370 Hard prompts: 1416 (95% CI 1412–1421) 1416 #140 · 37K votes
Each dot is Qwen3.5 Flash 02.23's Arena score in that category; the whisker is the 95% CI; the firm tick is the peer median across distinct models; faint ticks are the field. This is human preference — which answer people pick in a blind A/B — not a correctness or capability score, and adjacent ranks routinely overlap within their intervals.
Source: LMArena (LMArena Leaderboard (lmarena.ai) — lmarena-ai/leaderboard-dataset on Hugging Face, CC BY 4.0.). Ratings are the style-controlled estimates (length/formatting confound removed), as of 2026-07-27.
Cost vs quality where Qwen3.5 Flash 02.23 sits among GPQA-scored models cheaper & higher-scoring 0% 25% 50% 75% 100% $0.00001 $0.0001 $0.001 $0.01 $0.1 $1 $10 $100 $1K Cost per request · 1K in / 500 out (log) GPQA Diamond Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3 Opus — 30% GPQA · $0.0525/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Opus 4.8 — 88% GPQA · $0.0175/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Claude Sonnet 5 — 87% GPQA · $0.007/req Llama 2 70b Chat HF — 2% GPQA · $0.0015/req Meta Llama 3 70B Instruct — 21% GPQA · $0.0015/req Meta Llama 3 8B Instruct — 1% GPQA · $0.000225/req Mixtral 8x7B Instruct — 7% GPQA · $0.000225/req GPT 4o — 32% GPQA · $0.00825/req GPT 4o — 31% GPQA · $0.00825/req GPT 4o Mini — 17% GPQA · $0.000495/req GPT 5 — 82% GPQA · $0.006875/req GPT 5 Mini — 67% GPQA · $0.001375/req GPT 5 Nano — 59% GPQA · $0.000275/req GPT 5.1 — 84% GPQA · $0.00688/req GPT 5.4 — 91% GPQA · $0.011/req GPT 5.4 — 91% GPQA · $0.011/req GPT 5.5 — 92% GPQA · $0.022/req GPT 5.5 — 92% GPQA · $0.022/req GPT 5.6 Luna — 89% GPQA · $0.0044/req GPT 5.6 Sol — 91% GPQA · $0.022/req GPT 5.6 Terra — 91% GPQA · $0.011/req O1 — 69% GPQA · $0.0495/req O1 Mini — 50% GPQA · $0.00363/req O1 Preview — 34% GPQA · $0.0495/req O3 Mini — 69% GPQA · $0.00363/req GPT 4o — 32% GPQA · $0.0075/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 4o — 32% GPQA · $0.0075/req GPT 4o — 31% GPQA · $0.0075/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 3.5 Turbo — 4% GPQA · $0.00125/req GPT 3.5 Turbo 0125 — 3% GPQA · $0.00125/req GPT 35 Turbo — 4% GPQA · $0.00125/req GPT 35 Turbo 0125 — 3% GPQA · $0.00125/req GPT 35 Turbo 1106 — 4% GPQA · $0.002/req GPT 4 — 8% GPQA · $0.06/req GPT 4.0125 Preview — 8% GPQA · $0.025/req GPT 4.0613 — 8% GPQA · $0.06/req GPT 4.1106 Preview — 8% GPQA · $0.025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4.5 Preview — 58% GPQA · $0.15/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o — 32% GPQA · $0.0125/req GPT 4o — 32% GPQA · $0.0075/req GPT 4o — 31% GPQA · $0.00825/req GPT 4o Mini — 17% GPQA · $0.000495/req GPT 4o Mini — 17% GPQA · $0.000495/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.2 — 89% GPQA · $0.00875/req GPT 5.2 — 89% GPQA · $0.00875/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.6 Luna — 89% GPQA · $0.004/req GPT 5.6 Sol — 91% GPQA · $0.02/req GPT 5.6 Terra — 91% GPQA · $0.01/req Mistral Large 2402 — 18% GPQA · $0.02/req Mistral Large Latest — 35% GPQA · $0.02/req O1 — 69% GPQA · $0.045/req O1 — 69% GPQA · $0.045/req O1 Mini — 50% GPQA · $0.00363/req O1 Mini — 50% GPQA · $0.0033/req O1 Preview — 69% GPQA · $0.045/req O1 Preview — 34% GPQA · $0.045/req O3 — 76% GPQA · $0.006/req O3 — 76% GPQA · $0.006/req O3 Mini — 69% GPQA · $0.0033/req O3 Mini — 69% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req GPT 4.1 — 56% GPQA · $0.0066/req GPT 4.1 Mini — 54% GPQA · $0.00132/req GPT 4.1 Nano — 32% GPQA · $0.00033/req GPT 4o — 32% GPQA · $0.00825/req GPT 4o — 31% GPQA · $0.00825/req GPT 4o Mini — 17% GPQA · $0.000495/req GPT 5 — 82% GPQA · $0.006875/req GPT 5 Mini — 67% GPQA · $0.001375/req GPT 5 Nano — 59% GPQA · $0.000275/req GPT 5.1 — 84% GPQA · $0.00688/req GPT 5.4 — 91% GPQA · $0.011/req GPT 5.4 — 91% GPQA · $0.011/req GPT 5.5 — 92% GPQA · $0.022/req GPT 5.5 — 92% GPQA · $0.022/req GPT 5.6 Luna — 89% GPQA · $0.0044/req GPT 5.6 Sol — 91% GPQA · $0.022/req GPT 5.6 Terra — 91% GPQA · $0.011/req O1 — 69% GPQA · $0.0495/req O1 Mini — 50% GPQA · $0.00363/req O1 Preview — 34% GPQA · $0.0495/req O3 — 76% GPQA · $0.0066/req O3 Mini — 69% GPQA · $0.00363/req O4 Mini — 73% GPQA · $0.00363/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Opus 4.8 — 88% GPQA · $0.0175/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Claude Sonnet 5 — 87% GPQA · $0.007/req Deepseek R1 — 62% GPQA · $0.00405/req Deepseek — 42% GPQA · $0.00342/req Deepseek v3 0324 — 57% GPQA · $0.00342/req Deepseek V4 Pro — 86% GPQA · $0.00348/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.5 — 92% GPQA · $0.02/req GPT Oss 120b — 68% GPQA · $0.00045/req Grok 4 — 83% GPQA · $0.0105/req Kimi K2.6 — 88% GPQA · $0.00295/req Llama 3.2 90B Vision Instruct — 21% GPQA · $0.00306/req Llama 3.3 70B Instruct — 30% GPQA · $0.001065/req Llama 4 Maverick 17B 128E Instruct Fp8 — 56% GPQA · $0.001585/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.00059/req Meta Llama 3 70B Instruct — 21% GPQA · $0.001285/req Mistral Large — 35% GPQA · $0.01/req Mistral Large 2407 — 32% GPQA · $0.005/req Mistral Large Latest — 35% GPQA · $0.005/req Mistral Medium 2505 — 46% GPQA · $0.0014/req Mistral Small — 30% GPQA · $0.0025/req Mistral Small 2503 — 30% GPQA · $0.00025/req Phi 3 Medium 128k Instruct — 3% GPQA · $0.00051/req Phi 4 — 41% GPQA · $0.000375/req GPT 3.5 Turbo Instruct 0914 — 4% GPQA · $0.0025/req GPT 35 Turbo Instruct — 4% GPQA · $0.0025/req GPT 35 Turbo Instruct 0914 — 4% GPQA · $0.0025/req Deepseek v3 0324 — 57% GPQA · $0.001155/req GPT Oss 120b — 68% GPQA · $0.00035/req Glm 4.7 — 78% GPQA · $0.0017/req Glm 5 — 84% GPQA · $0.002525/req GPT Oss 120b — 68% GPQA · $0.000725/req Llama 3.3 70b — 30% GPQA · $0.00145/req Llama3.1 70b — 26% GPQA · $0.0009/req Llama3.1 8b — 1% GPQA · $0.00015/req Llama 4 Scout 17b 16e Instruct — 36% GPQA · $0.000695/req Kimi K2.6 — 88% GPQA · $0.00295/req Kimi K2.7 Code — 86% GPQA · $0.00295/req GPT Oss 120b — 68% GPQA · $0.000725/req Glm 5.2 — 89% GPQA · $0.0036/req Deepseek R1 0528 — 68% GPQA · $0.0065/req Deepseek v3 0324 — 57% GPQA · $0.00225/req Llama 3.3 70B Instruct — 30% GPQA · $0.0003/req GPT Oss 120b — 68% GPQA · $0.0012/req Qwen Max — 41% GPQA · $0.0048/req Claude 3.7 Sonnet Latest — 73% GPQA · $0.01155/req Deepseek R1 — 62% GPQA · $0.0019/req Deepseek R1 0528 — 68% GPQA · $0.001575/req Deepseek — 42% GPQA · $0.000825/req Deepseek v3 0324 — 57% GPQA · $0.00069/req Gemini 2.0 Flash 001 — 52% GPQA · $0.0003/req Gemini 2.5 Pro — 80% GPQA · $0.00625/req Gemma 3 27b It — 32% GPQA · $0.00017/req Llama 3.3 70B Instruct — 30% GPQA · $0.00043/req Llama 4 Maverick 17B 128E Instruct Fp8 — 56% GPQA · $0.00045/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.00023/req Meta Llama 3 8B Instruct — 1% GPQA · $0.00006/req Phi 4 — 41% GPQA · $0.00014/req Mixtral 8x7B Instruct — 7% GPQA · $0.0006/req GPT Oss 120b — 68% GPQA · $0.000275/req Qwen2.5 72B Instruct — 32% GPQA · $0.000315/req Qwen3 235B A22b — 61% GPQA · $0.00045/req Qwen3 235B A22b Thinking 2507 — 73% GPQA · $0.00175/req Deepseek Reasoner — 78% GPQA · $0.00049/req Deepseek V4 Pro — 86% GPQA · $0.00087/req Deepseek R1 — 62% GPQA · $0.001645/req Deepseek Reasoner — 78% GPQA · $0.00049/req Deepseek — 42% GPQA · $0.00082/req Deepseek V4 Pro — 86% GPQA · $0.00087/req Deepseek R1 — 62% GPQA · $0.007/req Deepseek R1 0528 — 68% GPQA · $0.007/req Deepseek — 42% GPQA · $0.00135/req Deepseek v3 0324 — 57% GPQA · $0.00135/req Deepseek V4 Pro — 86% GPQA · $0.00348/req Gemma 3 27b It — 32% GPQA · $0.00135/req Gemma2 9b It — 3% GPQA · $0.0003/req GPT Oss 120b — 68% GPQA · $0.00045/req Kimi K2p5 — 83% GPQA · $0.0021/req Qwen2 72b Instruct — 21% GPQA · $0.00135/req Qwen3 235b A22b — 61% GPQA · $0.00066/req Qwen3 235b A22b Thinking 2507 — 73% GPQA · $0.00066/req Yi 34b Chat — 0% GPQA · $0.00135/req Deepseek V4 Pro — 86% GPQA · $0.00348/req GPT Oss 120b — 68% GPQA · $0.00045/req Kimi K2p5 — 83% GPQA · $0.0021/req Gemini 2.0 Flash 001 — 52% GPQA · $0.0003/req Gemini 2.5 Pro — 80% GPQA · $0.00625/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req Gemini 3.1 Pro Preview — 92% GPQA · $0.008/req Gemini 3.5 Flash — 90% GPQA · $0.006/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Deepseek v3 0324 — 57% GPQA · $0.00072/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 5 — 82% GPQA · $0.00625/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.2 — 89% GPQA · $0.00875/req Llama3.3 70b Instruct — 30% GPQA · $0.000975/req Llama 4 Scout 17b 16e Instruct — 36% GPQA · $0.00028/req GPT Oss 120b — 68% GPQA · $0.00045/req Deepseek R1 — 62% GPQA · $0.0006/req Deepseek R1 0528 — 68% GPQA · $0.000375/req Deepseek — 42% GPQA · $0.0003/req Deepseek v3 0324 — 57% GPQA · $0.0006/req Llama 3.3 70B Instruct — 30% GPQA · $0.00027/req Meta Llama 3 70B Instruct — 21% GPQA · $0.00027/req Qwen2.5 72B Instruct — 32% GPQA · $0.00027/req Qwen3 235B A22b — 61% GPQA · $0.003/req Deepseek R1 0528 — 68% GPQA · $0.0005/req Deepseek v3 0324 — 57% GPQA · $0.0005/req Llama 4 Maverick 17b 128e Instruct Fp8 — 56% GPQA · $0.0001/req Llama 4 Scout 17b 16e Instruct — 36% GPQA · $0.0001/req Llama3.1 8b Instruct — 1% GPQA · $0.000045/req Llama 3.1 8b — 1% GPQA · $0.000055/req Magistral Small 2506 — 31% GPQA · $0.00125/req Magistral Small Latest — 31% GPQA · $0.00125/req Mistral Large 2402 — 18% GPQA · $0.01/req Mistral Large 2407 — 32% GPQA · $0.0075/req Mistral Large 2411 — 35% GPQA · $0.005/req Mistral Large 2512 — 35% GPQA · $0.00125/req Mistral Large Latest — 35% GPQA · $0.00125/req Mistral Medium — 46% GPQA · $0.00675/req Mistral Medium 2312 — 46% GPQA · $0.00675/req Mistral Medium 2505 — 46% GPQA · $0.0014/req Mistral Medium 2508 — 46% GPQA · $0.0014/req Mistral Medium 2604 — 46% GPQA · $0.00525/req Mistral Medium Latest — 46% GPQA · $0.00525/req Mistral Small — 30% GPQA · $0.00025/req Mistral Small Latest — 30% GPQA · $0.00015/req Open Mistral Nemo — 7% GPQA · $0.00045/req Open Mistral Nemo 2407 — 7% GPQA · $0.00045/req Open Mixtral 8x22b — 12% GPQA · $0.005/req Kimi K2 Thinking Turbo — 79% GPQA · $0.00515/req Kimi K2.6 — 88% GPQA · $0.00295/req Deepseek R1 — 62% GPQA · $0.002/req Deepseek R1 0528 — 68% GPQA · $0.002/req Deepseek — 42% GPQA · $0.00125/req Deepseek v3 0324 — 57% GPQA · $0.00125/req Gemma 3 27b It — 32% GPQA · $0.00016/req Llama 3.3 70B Instruct — 30% GPQA · $0.00033/req Qwen2.5 72B Instruct — 32% GPQA · $0.00033/req Qwen3 235B A22b — 61% GPQA · $0.0005/req Deepseek R1 0528 — 68% GPQA · $0.00195/req Deepseek v3 0324 — 57% GPQA · $0.00083/req Gemma 3 27b It — 32% GPQA · $0.000219/req Llama 3.1 8b Instruct — 1% GPQA · $0.000045/req Llama 3.3 70b Instruct — 30% GPQA · $0.000335/req Llama 4 Maverick 17b 128e Instruct Fp8 — 56% GPQA · $0.000695/req Llama 4 Scout 17b 16e Instruct — 36% GPQA · $0.000475/req GPT Oss 120b — 68% GPQA · $0.000175/req Qwen 2.5 72b Instruct — 32% GPQA · $0.00058/req Qwen3 235b A22b Thinking 2507 — 73% GPQA · $0.0018/req Qwen3 Max — 63% GPQA · $0.006335/req Glm 4.7 — 78% GPQA · $0.0017/req Llama 3.1 8B Instruct — 1% GPQA · $0.000045/req Llama 3.3 70B Instruct — 30% GPQA · $0.0003/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.000235/req GPT 3.5 Turbo — 4% GPQA · $0.00125/req GPT 3.5 Turbo 0125 — 3% GPQA · $0.00125/req GPT 3.5 Turbo 1106 — 4% GPQA · $0.002/req GPT 4 — 8% GPQA · $0.06/req GPT 4.0125 Preview — 8% GPQA · $0.025/req GPT 4.0314 — 14% GPQA · $0.06/req GPT 4.0613 — 8% GPQA · $0.06/req GPT 4.1106 Preview — 8% GPQA · $0.025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4 Turbo Preview — 29% GPQA · $0.025/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o — 32% GPQA · $0.0125/req GPT 4o — 32% GPQA · $0.0075/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.1 — 84% GPQA · $0.00625/req GPT 5.2 — 89% GPQA · $0.00875/req GPT 5.2 — 89% GPQA · $0.00875/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 — 91% GPQA · $0.01/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Mini — 78% GPQA · $0.003/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Nano — 71% GPQA · $0.000825/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.4 Pro — 93% GPQA · $0.12/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.5 — 92% GPQA · $0.02/req GPT 5.6 Luna — 89% GPQA · $0.004/req GPT 5.6 Sol — 91% GPQA · $0.02/req GPT 5.6 Terra — 91% GPQA · $0.01/req O1 — 69% GPQA · $0.045/req O1 — 69% GPQA · $0.045/req O3 — 76% GPQA · $0.006/req O3 — 76% GPQA · $0.006/req O3 Mini — 69% GPQA · $0.0033/req O3 Mini — 69% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Deepseek R1 — 62% GPQA · $0.001645/req Deepseek R1 0528 — 68% GPQA · $0.001575/req Gemini 2.0 Flash 001 — 52% GPQA · $0.0003/req Gemini 2.5 Pro — 80% GPQA · $0.00625/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req Gemini 3.1 Pro Preview — 92% GPQA · $0.008/req Mistral Large — 35% GPQA · $0.02/req Mistral Large 2512 — 35% GPQA · $0.00125/req GPT 3.5 Turbo — 4% GPQA · $0.0025/req GPT 4 — 8% GPQA · $0.06/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o — 32% GPQA · $0.0125/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT 5.2 — 89% GPQA · $0.00875/req GPT Oss 120b — 68% GPQA · $0.00058/req O1 — 69% GPQA · $0.045/req O3 Mini — 69% GPQA · $0.0033/req Qwen3 235b A22b 2507 — 61% GPQA · $0.000121/req Qwen3 235b A22b Thinking 2507 — 73% GPQA · $0.00041/req Qwen3.5 Plus 02.15 — 79% GPQA · $0.0016/req Qwen3.6 Plus — 83% GPQA · $0.0013/req Grok 4 — 83% GPQA · $0.0105/req Glm 4.7 — 78% GPQA · $0.00115/req Glm 5 — 84% GPQA · $0.00208/req Glm 5.1 — 81% GPQA · $0.0028/req GPT Oss 120b — 68% GPQA · $0.00028/req Llama 3.1 8B Instruct — 1% GPQA · $0.00015/req Mixtral 8x7B Instruct — 7% GPQA · $0.000945/req Llama 3.1 70b Instruct — 26% GPQA · $0.0015/req Llama 3.1 8b Instruct — 1% GPQA · $0.0003/req Claude 3.5 Haiku — 18% GPQA · $0.0035/req Claude 3.5 Sonnet — 40% GPQA · $0.013125/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Deepseek R1 — 62% GPQA · $0.00875/req Deepseek — 42% GPQA · $0.002175/req Gemini 3 Pro — 90% GPQA · $0.008/req Mixtral 8x7b Instruct — 7% GPQA · $0.0008/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req GPT 5 — 82% GPQA · $0.00625/req GPT 5 Mini — 67% GPQA · $0.00125/req GPT 5 Nano — 59% GPQA · $0.00025/req GPT Oss 120b — 68% GPQA · $0.00054/req O1 — 69% GPQA · $0.045/req O1 Mini — 50% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.003/req Grok 4 — 83% GPQA · $0.0252/req Deepseek R1 — 62% GPQA · $0.0085/req Deepseek v3 0324 — 57% GPQA · $0.00525/req GPT Oss 120b — 68% GPQA · $0.000515/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.00075/req Gemma 3 27b It — 32% GPQA · $0.0005/req Llama 3.3 70b Instruct — 30% GPQA · $0.00135/req GPT Oss 120b — 68% GPQA · $0.00045/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Deepseek R1 — 62% GPQA · $0.00405/req Llama3.1 405b — 35% GPQA · $0.0018/req Llama3.1 70b — 26% GPQA · $0.00108/req Llama3.1 8b — 1% GPQA · $0.00036/req Llama3.3 70b — 30% GPQA · $0.00108/req Deepseek V4 Pro — 86% GPQA · $0.00087/req Kimi K2.6 — 88% GPQA · $0.00296/req GPT Oss 120b — 68% GPQA · $0.00045/req GPT 3.5 Turbo Instruct — 4% GPQA · $0.0025/req GPT 3.5 Turbo Instruct 0914 — 4% GPQA · $0.0025/req Deepseek R1 — 62% GPQA · $0.0065/req Deepseek — 42% GPQA · $0.001875/req Llama 4 Maverick 17B 128E Instruct Fp8 — 56% GPQA · $0.000695/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $0.000475/req Mixtral 8x7B Instruct — 7% GPQA · $0.0009/req GPT Oss 120b — 68% GPQA · $0.00045/req Qwen3 235B A22b Thinking 2507 — 73% GPQA · $0.00215/req Glm 4.7 — 78% GPQA · $0.00145/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3 Opus — 30% GPQA · $0.0525/req Claude 3.5 Haiku — 18% GPQA · $0.0028/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Deepseek R1 — 62% GPQA · $0.001645/req Deepseek — 42% GPQA · $0.00135/req Gemini 2.5 Pro — 80% GPQA · $0.0075/req Gemma 2 9b — 3% GPQA · $0.0003/req Llama 3.1 70b — 26% GPQA · $0.00108/req Llama 3.1 8b — 1% GPQA · $0.00009/req Llama 3.3 70b — 30% GPQA · $0.00108/req Magistral Small — 31% GPQA · $0.00125/req Mistral Large — 35% GPQA · $0.005/req Mistral Small — 30% GPQA · $0.00025/req GPT 3.5 Turbo — 4% GPQA · $0.00125/req GPT 3.5 Turbo Instruct — 4% GPQA · $0.0025/req GPT 4 Turbo — 29% GPQA · $0.025/req GPT 4.1 — 56% GPQA · $0.006/req GPT 4.1 Mini — 54% GPQA · $0.0012/req GPT 4.1 Nano — 32% GPQA · $0.0003/req GPT 4o — 31% GPQA · $0.0075/req GPT 4o Mini — 17% GPQA · $0.00045/req O1 — 69% GPQA · $0.045/req O3 — 76% GPQA · $0.006/req O3 Mini — 69% GPQA · $0.0033/req O4 Mini — 73% GPQA · $0.0033/req Grok 2 — 38% GPQA · $0.007/req Grok 4 — 83% GPQA · $0.0105/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req Gemini 3.1 Pro Preview — 92% GPQA · $0.008/req Gemini 3.5 Flash — 90% GPQA · $0.006/req Claude 3.5 Haiku — 18% GPQA · $0.0035/req Claude 3.5 Haiku — 18% GPQA · $0.0035/req Claude 3.5 Sonnet — 40% GPQA · $0.0105/req Claude 3.5 Sonnet — 39% GPQA · $0.0105/req Claude 3.7 Sonnet — 73% GPQA · $0.0105/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3 Haiku — 15% GPQA · $0.000875/req Claude 3 Opus — 30% GPQA · $0.0525/req Claude 3 Opus — 30% GPQA · $0.0525/req Claude 3 Sonnet — 21% GPQA · $0.0105/req Claude 3 Sonnet — 21% GPQA · $0.0105/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Haiku 4.5 — 62% GPQA · $0.0035/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.1 — 70% GPQA · $0.0525/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.5 — 81% GPQA · $0.0175/req Claude Opus 4.6 — 87% GPQA · $0.0175/req Claude Opus 4.7 — 87% GPQA · $0.0175/req Claude Opus 4.8 — 88% GPQA · $0.0175/req Claude Opus 4 — 68% GPQA · $0.0525/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.5 — 76% GPQA · $0.0105/req Claude Sonnet 4.6 — 83% GPQA · $0.0105/req Claude Sonnet 4 — 72% GPQA · $0.0105/req Claude Sonnet 5 — 87% GPQA · $0.007/req Gemini 2.0 Flash 001 — 52% GPQA · $0.00045/req Gemini 2.5 Pro — 80% GPQA · $0.00625/req Gemini 3 Flash Preview — 78% GPQA · $0.002/req Gemini 3 Pro Preview — 90% GPQA · $0.008/req Gemini 3.1 Pro Preview — 92% GPQA · $0.008/req Gemini 3.5 Flash — 90% GPQA · $0.006/req Mistral Large 2411 — 35% GPQA · $0.005/req Mistral Large — 32% GPQA · $0.005/req Mistral Small 2503 — 30% GPQA · $0.0025/req Deepseek R1 0528 — 68% GPQA · $405.00/req Deepseek v3 0324 — 57% GPQA · $251.50/req Llama 3.1 8B Instruct — 1% GPQA · $33.00/req Llama 3.3 70B Instruct — 30% GPQA · $106.50/req Llama 4 Scout 17B 16E Instruct — 36% GPQA · $50.00/req GPT Oss 120b — 68% GPQA · $45.00/req Qwen3 235B A22b Thinking 2507 — 73% GPQA · $15.00/req Llama 3.2 90b Vision Instruct — 21% GPQA · $0.003/req Llama 3.3 70b Instruct — 30% GPQA · $0.001065/req Mistral Large — 35% GPQA · $0.008/req Mistral Medium 2505 — 46% GPQA · $0.008/req Mistral Small 2503 — 30% GPQA · $0.00025/req GPT Oss 120b — 68% GPQA · $0.00045/req Grok 2 — 38% GPQA · $0.007/req Grok 2.1212 — 38% GPQA · $0.007/req Grok 2 Latest — 38% GPQA · $0.007/req Grok 3 Beta — 68% GPQA · $0.0105/req Grok 3 Latest — 68% GPQA · $0.0105/req Grok 3 Mini Beta — 68% GPQA · $0.00055/req Grok 3 Mini Latest — 68% GPQA · $0.00055/req Grok 4 — 83% GPQA · $0.0105/req Grok 4.0709 — 83% GPQA · $0.0105/req Grok 4 Latest — 83% GPQA · $0.0105/req Grok 4.20.0309 Reasoning — 86% GPQA · $0.005/req Grok 4.3 — 85% GPQA · $0.0025/req Grok 4.3 Latest — 85% GPQA · $0.0025/req Grok 4.5 — 91% GPQA · $0.005/req Grok 4.5 Latest — 91% GPQA · $0.005/req Glm 4.7 — 78% GPQA · $0.0017/req Glm 5 — 84% GPQA · $0.0026/req Glm 5.1 — 81% GPQA · $0.0036/req Qwen3.5 Flash 02.23 — 78% GPQA at $0.0003/req Qwen3.5 Flash 02.23 Each dot is a model with a GPQA Diamond score, priced at a 1K-in / 500-out request; Qwen3.5 Flash 02.23 is highlighted. The shaded corner holds models that are both cheaper and higher-scoring; the dashed staircase is the value frontier. Hover any dot for its model.
Also worth considering cheaper models that score about as well — pick the benchmark that matters to you 1 cheaper model scores within 3 points of Qwen3.5 Flash 02.23 on AIME (OTIS mock) .
Pricing Input · fresh prompt tokens $0.10 / M Output · generated tokens $0.40 / M Cache read · cached-input hit unknown Cache write · cache creation unknown Reasoning · thinking tokens unknown
Reasoning tokens: no separate rate is published. Providers typically bill thinking tokens at the output rate ($0.40 / M) — which is what the estimator assumes, so an extended-thinking workload isn't silently undercounted.
Model info
Provider OpenRouter
Catalog key openrouter/openrouter/qwen/qwen3.5-flash-02-23
Identifier Floating alias (may re-point over time)
Type Chat
Max input 1,000,000 tokens
Max output 65,536 tokens
Released 2026-02-26
Knowledge cutoff unknown
Weights Open weights
Price snapshot 2026-07-14 · rev 179affb Pricing from TokenTriage's resolved price artifact (TokenTriage resolved price artifact (internal/pricing/data/prices.json) ); capability + model metadata is third-party (LiteLLM model_prices_and_context_window.json, models.dev). Unknown means unstated, not absent.
Capabilities 3 documented as supportedInput & output
✓ Vision
? PDF input
? Audio input
? Audio output
API behaviour
? Streaming
? Structured output
? Prompt caching
✓ Reasoning
Agents & tools
✓ Function calling
? Parallel tool calls
? Web search
? Computer use
✓ supported ·✕ not supported ·? not documented ·⚠ sources disagree. A models.dev tag means the LiteLLM catalog was silent and an independent source supplied the value (lower confidence); ? is never silently turned into a confident ✕.
Estimate a request disjoint token buckets · input = fresh (uncached) tokens Preset Chat turn RAG · 8K ctx Agent · 20 tools Batch summarize
Cost / request —
Projected / month —
How output length drives the bill at a 1K-token prompt · cost scales linearly with output $0.01 $0.01 $0.007 $0.003 $0 0 16K 33K 49K 66K Output tokens Cost / request max output output spend = input spend at ~250 tokens output spend overtakes input at ~250 Output tokens overtake input spend at ~250 tokens for this model — past that, generation is your bill, whatever the headline input price says. Computed by the same cost engine as the estimate above.
Route to Qwen3.5 Flash 02.23 OpenAI-compatible · one base URL cURL Python
Copy curl https://YOUR-TOKENTRIAGE-HOST/v1/chat/completions \
-H "Authorization: Bearer $TOKENTRIAGE_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openrouter/openrouter/qwen/qwen3.5-flash-02-23",
"messages": [{"role": "user", "content": "Hello"}]
}'from openai import OpenAI
client = OpenAI(
base_url="https://YOUR-TOKENTRIAGE-HOST/v1",
api_key="YOUR_TOKENTRIAGE_KEY",
)
resp = client.chat.completions.create(
model="openrouter/openrouter/qwen/qwen3.5-flash-02-23",
messages=[{"role": "user", "content": "Hello"}],
)
print(resp.choices[0].message.content)Point your existing OpenAI client at your TokenTriage host and pass the catalog key as the model. TokenTriage attributes the real cost per request and can route to a cheaper model once it's proven just as good on your traffic.
Data & API machine-readable · rev 179affb Pull this model's pricing, capabilities, benchmarks and cross-source provenance programmatically — every field carries the snapshot rev, and unknown is null, never 0. Free to reuse with attribution: benchmarks & Capabilities Index © Epoch AI (CC-BY (Epoch AI)); human-preference Elo © LMArena (CC-BY-4.0); capability & price cross-check via models.dev v2 (MIT) · Portkey (MIT) · TrueFoundry (MIT); open-weights facts via Hugging Face (per-repo license).
A price is a guess until it meets your traffic. This page tells you what Qwen3.5 Flash 02.23 charges per token. TokenTriage tells you what it costs on your real requests — and cuts the bill only after proving a cheaper model is just as good.