Runyard / LLM API Index · GPU Index →

LLM API Pricing Index

Input and output price per million tokens for 440 models from 59 vendors, in one schema. 418 are paid, 22 have a free tier. Blended price assumes 3 input tokens per output token, the ratio most chat and agent work lands near.

Last collected 2026-09-12 · 7 snapshots

Models priced
44059 vendors
Median paid model
$0.850/1M blended
Frontier tier
$20.00/1M blended
Cheapest paid
$0.022Mistral Nemo
Flagships, blended $/1M tokens
3 input : 1 output · as listed on OpenRouter
Claude Fable 5.1$20.00GPT-6 Astra$20.00Grok 4.6$3.00Kimi K3$5.31DeepSeek V4.1 Flash$0.26GLM 5.3 Flash$0.24Gemini 3.8 Flash$1.50

The spread is the story: the frontier tier costs 13× the cheapest flagship-class model on this chart, for work that often does not need it.

Every model

ContextCache read7D
Qwen3.7 FlashAlibaba Qwen · qwen/qwen3.7-flash1M$0.030$0.130$0.055$0.0060
Qwen3.5-9BAlibaba Qwen · qwen/qwen3.5-9b262K$0.100$0.150$0.113
Qwen3.5-FlashAlibaba Qwen · qwen/qwen3.5-flash-02-231M$0.065$0.260$0.114
Qwen3 Coder 30B A3B InstructAlibaba Qwen · qwen/qwen3-coder-30b-a3b-instruct262K$0.070$0.280$0.122
Qwen2.5 7B InstructAlibaba Qwen · qwen/qwen-2.5-7b-instruct33K$0.100$0.200$0.125
Qwen3 32BAlibaba Qwen · qwen/qwen3-32b131K$0.080$0.280$0.130
Qwen3 30B A3B Instruct 2507Alibaba Qwen · qwen/qwen3-30b-a3b-instruct-2507262K$0.090$0.300$0.142
Qwen3 235B A22B Instruct 2507Alibaba Qwen · qwen/qwen3-235b-a22b-2507262K$0.087$0.350$0.153$0.018
Qwen3 VL 32B InstructAlibaba Qwen · qwen/qwen3-vl-32b-instruct131K$0.104$0.416$0.182
Qwen3.5-9B (batch)Alibaba Qwen · qwen/qwen3.5-9b:batch262K$0.170$0.250$0.190
Qwen3 VL 8B InstructAlibaba Qwen · qwen/qwen3-vl-8b-instruct262K$0.117$0.455$0.202
Qwen3 8BAlibaba Qwen · qwen/qwen3-8b131K$0.117$0.455$0.202
Qwen3 30B A3BAlibaba Qwen · qwen/qwen3-30b-a3b131K$0.120$0.500$0.215
Qwen3.8 FlashAlibaba Qwen · qwen/qwen3.8-flash1M$0.150$0.470$0.230$0.016
Qwen3 VL 30B A3B InstructAlibaba Qwen · qwen/qwen3-vl-30b-a3b-instruct262K$0.150$0.600$0.263
Qwen3 Coder NextAlibaba Qwen · qwen/qwen3-coder-next262K$0.120$0.800$0.290$0.070
Qwen3.6 35B A3BAlibaba Qwen · qwen/qwen3.6-35b-a3b262K$0.100$0.900$0.300$0.050
Qwen3 Next 80B A3B InstructAlibaba Qwen · qwen/qwen3-next-80b-a3b-instruct262K$0.090$1.10$0.343
Qwen2.5 72B InstructAlibaba Qwen · qwen/qwen-2.5-72b-instruct33K$0.360$0.400$0.370
Qwen3 Coder FlashAlibaba Qwen · qwen/qwen3-coder-flash1M$0.195$0.975$0.390$0.039
Qwen Plus 0728Alibaba Qwen · qwen/qwen-plus-2025-07-281M$0.260$0.780$0.390
Qwen-PlusAlibaba Qwen · qwen/qwen-plus1M$0.260$0.780$0.390$0.052
Qwen3 14BAlibaba Qwen · qwen/qwen3-14b131K$0.228$0.910$0.398
Qwen3 Next 80B A3B ThinkingAlibaba Qwen · qwen/qwen3-next-80b-a3b-thinking262K$0.150$1.20$0.412
Qwen3.6 FlashAlibaba Qwen · qwen/qwen3.6-flash1M$0.188$1.13$0.422
Qwen3 Coder 480B A35BAlibaba Qwen · qwen/qwen3-coder262K$0.300$1.00$0.475$0.100
Qwen3.5-27BAlibaba Qwen · qwen/qwen3.5-27b262K$0.195$1.56$0.536
Qwen3.5-35B-A3BAlibaba Qwen · qwen/qwen3.5-35b-a3b262K$0.313$1.25$0.547$0.156
Qwen3.7 PlusAlibaba Qwen · qwen/qwen3.7-plus1M$0.320$1.28$0.560$0.064
Qwen3.5 Plus 2026-02-15Alibaba Qwen · qwen/qwen3.5-plus-02-151M$0.260$1.56$0.585
Qwen3 VL 235B A22B InstructAlibaba Qwen · qwen/qwen3-vl-235b-a22b-instruct262K$0.210$1.90$0.632$0.100
Qwen3 VL 8B ThinkingAlibaba Qwen · qwen/qwen3-vl-8b-thinking131K$0.180$2.10$0.660
Qwen3.5 Plus 2026-04-20Alibaba Qwen · qwen/qwen3.5-plus-202604201M$0.300$1.80$0.675
Qwen3.5-122B-A10BAlibaba Qwen · qwen/qwen3.5-122b-a10b262K$0.260$2.08$0.715
Qwen3.6 27BAlibaba Qwen · qwen/qwen3.6-27b262K$0.300$2.00$0.725$0.030
Qwen3.6 PlusAlibaba Qwen · qwen/qwen3.6-plus1M$0.325$1.95$0.731
Qwen2.5 Coder 32B InstructAlibaba Qwen · qwen/qwen-2.5-coder-32b-instruct33K$0.660$1.00$0.745
Qwen3 235B A22B Thinking 2507Alibaba Qwen · qwen/qwen3-235b-a22b-thinking-2507131K$0.230$2.30$0.748
Qwen3 VL 30B A3B ThinkingAlibaba Qwen · qwen/qwen3-vl-30b-a3b-thinking262K$0.200$2.40$0.750
Qwen3 30B A3B Thinking 2507Alibaba Qwen · qwen/qwen3-30b-a3b-thinking-250782K$0.200$2.40$0.750
Qwen3 235B A22BAlibaba Qwen · qwen/qwen3-235b-a22b131K$0.455$1.82$0.796
Qwen3.8 27BAlibaba Qwen · qwen/qwen3.8-27b1M$0.214$2.55$0.798$0.150
Qwen2.5 VL 72B InstructAlibaba Qwen · qwen/qwen2.5-vl-72b-instruct128K$0.800$1.00$0.850$0.400
Qwen3.5 397B A17BAlibaba Qwen · qwen/qwen3.5-397b-a17b262K$0.550$3.50$1.29$0.225
Qwen3 VL 235B A22B ThinkingAlibaba Qwen · qwen/qwen3-vl-235b-a22b-thinking131K$0.400$4.00$1.30
Qwen3 Coder PlusAlibaba Qwen · qwen/qwen3-coder-plus1M$0.650$3.25$1.30$0.130
Qwen3 Max ThinkingAlibaba Qwen · qwen/qwen3-max-thinking262K$0.780$3.90$1.56
Qwen3 MaxAlibaba Qwen · qwen/qwen3-max262K$0.780$3.90$1.56$0.156
Qwen3.7 MaxAlibaba Qwen · qwen/qwen3.7-max1M$1.48$4.42$2.21$0.295
Qwen3.6 Max PreviewAlibaba Qwen · qwen/qwen3.6-max-preview262K$1.03$6.16$2.31
Qwen3.8 Max (0902)Alibaba Qwen · qwen/qwen3.8-max-09021M$2.00$6.00$3.00$0.250
Qwen3.8 2.4T A95BAlibaba Qwen · qwen/qwen3.8-2.4t-a95b1.0M$2.00$6.00$3.00$0.250
Qwen3.8 2.4T A95B (batch)Alibaba Qwen · qwen/qwen3.8-2.4t-a95b:batch1.0M$2.00$6.00$3.00$0.250

53 of 53 models (free tiers hidden). Blended = 3 input tokens per output token. Prices as listed on OpenRouter on the date above.

Vendors

VendorModelsCheapest paid, blended
OpenAI93$0.055
Alibaba Qwen53$0.055
Google43$0.063
Anthropic27$0.500
Mistral25$0.022
DeepSeek18$0.050
Z.ai (Zhipu)17$0.119
NVIDIA10$0.087
MiniMax9$0.425
Moonshot AI8$0.900
Meta8$0.058
Meta7$0.125
Tencent7$0.077
xAI7$1.25
inclusionAI6$0.032
Bytedance Seed6$0.131
Thinking Machines6$0.637
~Openai5$0.450
Cohere5$0.066
Amazon5$0.061
Perplexity5$1.00
Sakana AI4$1.71
Poolside4$0.075
Aion Labs4$0.875
~Anthropic4$2.00
Thedrummer3$0.350
Nous Research3$0.700
Sao10k3$0.043
Inference Net2$0.060
Inception2$0.068
Nex Agi2
Ibm Granite2$0.041
~Z Ai2$0.119
Upstage2$0.158
Kwaipilot2$0.525
Stepfun2$0.150
~Google2$1.50
Xiaomi2$0.175
Rekaai2$0.100
Relace2$0.950
Morph2$0.900
Microsoft2$0.087
Dots Studio1
Liquid AI1
~Deepseek1$0.040
Meituan1$0.525
~X Ai1$3.00
Perceptron1$0.487
~Moonshotai1$5.11
Arcee Ai1$0.388
Openrouter1
Writer1$1.95
Bytedance1$0.125
Cognitivecomputations1$0.375
Baidu1$0.627
Anthracite Org1$3.13
Mancer1$0.487
Undi951$0.425
Gryphe1$0.060

How this is built

Prices are read from OpenRouter's public model list, which routes to each vendor and publishes the per-token price it charges — for nearly every model, the vendor's own list price passed through. It is the one place all vendors appear in one schema, which is why it is the source. Prices are shown as listed there; a vendor's direct price can differ, especially with volume discounts or provisioned throughput, and OpenRouter's own listing is the reference for what is shown.

Every collector run is stored as a snapshot and committed to the repository, so price changes are diffs anyone can inspect. Nothing is backfilled. The 7-day column compares a model against itself a week earlier and is blank until that run exists.

Blended weights input at 3 and output at 1. Change the ratio and the ranking changes — an output-heavy workload makes the frontier tier relatively more expensive, since output tokens cost five times input on most frontier models.

What the same tokens cost on hardware you rent or own.
Local cost per million tokens →