| 1 | Z.ai GLM-5.3-FlashBlend priced at promo $0.075/$0.25 — list-price blend $0.2375/M · Promo ends 2026-09-09 24:00 UTC+8API (per token) · 2 caveats | $0.07 / $0.25 | $0.119$0.012/taskcache: Cached input $0 | — | 42 | srcDIRECTread 2026-09-07 |
|---|
| 2 | Z.ai GLM-4.7-FlashX / Flash / 4.5-FlashZero-priced tiersAPI (per token) · 1 caveat | $0.07 / $0.40 | $0.153$0.015/taskcache: not published (free models | — | 15* | srcDIRECTread 2026-09-07 |
|---|
| 3 | DeepSeek deepseek-v4-flashPeak/off-peak split - see hoursAPI (per token) · 1 caveat | $0.22 / $0.66 | $0.330$0.033/taskcache: Cache-hit input $0 | — | 35 | srcDIRECTread 2026-09-07 |
|---|
| 4 | Z.ai GLM-4.6V / 4.5V / GLM-OCR / 4.6V-FlashLadder row; models not splitAPI (per token) · 1 caveat | $0.30 / $0.90 | $0.450$0.045/taskcache: Cached input e | — | — | srcDIRECTread 2026-09-07 |
|---|
| 5 | OpenAI gpt-5.6-lunaAPI (per token) · 0 caveats | $0.20 / $1.20 | $0.450$0.045/taskcache: 0 | $0.225~$0.022/task | 38 | srcDIRECTread 2026-09-07 |
|---|
| 6 | MiniMax MiniMax-M2.7API (per token) · 0 caveats | $0.30 / $1.20 | $0.525$0.052/taskcache: Cache-read $0 | — | 30 | srcEXCERPTread 2026-09-07 |
|---|
| 7 | Google Gemini 3.1 Flash-LiteAPI (per token) · 0 caveats | $0.25 / $1.50 | $0.563$0.056/taskcache: Cached input $0 | — | — | srcDIRECTread 2026-09-07 |
|---|
| 8 | OpenAI gpt-5-mini / gpt-5-nanoTwo models on one rowAPI (per token) · 1 caveat | $0.25 / $2.00 | $0.688$0.069/taskcache: 90% off cached input | $0.344~$0.034/task | 17 | srcDIRECTread 2026-09-07 |
|---|
| 9 | Mistral Mistral Large (API)Full table not renderedAPI (per token) · 1 caveat | $0.50 / $1.50 | $0.750$0.075/taskcache: Up to 90% off input for repeated prompts (cached input) | $0.375~$0.037/task | 10 | srcEXCERPTread 2026-09-07 |
|---|
| 10 | Google Gemini 2.5 Flash / 2.5 Flash-LiteTwo models on one rowAPI (per token) · 1 caveat | $0.30 / $2.50 | $0.850$0.085/taskcache: Cached input $0 | — | — | srcDIRECTread 2026-09-07 |
|---|
| 11 | DeepSeek deepseek-v4-proPeak/off-peak split - see hoursAPI (per token) · 1 caveat | $0.66 / $1.98 | $0.990$0.099/taskcache: Cache-hit input $0 | — | 36 | srcDIRECTread 2026-09-07 |
|---|
| 12 | Meta (Llama) via Together AI Llama 3.3 70B / Llama 3 8B Instruct LiteLlama 4 pricing unverifiedAPI (per token) · 1 caveat | $1.04 / $1.04 | $1.04$0.104/taskcache: Cached input prices shown per model | — | 9 | srcDIRECTread 2026-09-07 |
|---|
| 13 | MiniMax MiniMax-M2.7-highspeedPriority multipliers raise priceAPI (per token) · 1 caveat | $0.60 / $2.40 | $1.05$0.105/taskcache: Cache-read $0 | — | — | srcEXCERPTread 2026-09-07 |
|---|
| 14 | Google Gemini 3 Flash PreviewPreview tierAPI (per token) · 1 caveat | $0.50 / $3.00 | $1.13$0.113/taskcache: Cached input $0 | — | — | srcDIRECTread 2026-09-07 |
|---|
| 15 | Alibaba (Qwen) via Together AI Qwen3.6-Plus / Qwen3.5-397B-A17B / Qwen3.5-9B / Qwen3-235B-A22BResale pricing, not first-partyAPI (per token) · 1 caveat | $0.50 / $3.00 | $1.13$0.113/taskcache: Cached input $0 | — | — | srcDIRECTread 2026-09-07 |
|---|
| 16 | xAI grok-build-0.1 (coding)Whole-request repricing above 200kAPI (per token) · 1 caveat | $1.00 / $2.00 | $1.25$0.125/taskcache: Cached input $0 | — | — | srcDIRECTread 2026-09-07 |
|---|
| 17 | Google Gemini 3.8 / 3.7 / 3.6 FlashScheduled price increase 2027-01-01API (per token) · 1 caveat | $0.75 / $3.75 | $1.50$0.150/taskcache: Cached input $0 | ~$0.750~$0.075/task | 41 | srcDIRECTread 2026-09-07 |
|---|
| 18 | Z.ai GLM-5 / 4.7 / 4.6 / 4.5 ladderLadder row; models not splitAPI (per token) · 1 caveat | $1.00 / $3.20 | $1.55$0.155/taskcache: Cached input e | — | — | srcDIRECTread 2026-09-07 |
|---|
| 19 | xAI grok-4.3Whole-request repricing above 200kAPI (per token) · 1 caveat | $1.25 / $2.50 | $1.56$0.156/taskcache: Cached input $0 | — | — | srcDIRECTread 2026-09-07 |
|---|
| 20 | xAI grok-4.20-0309 (reasoning / non-reasoning / multi-agent)Logprobs unsupportedAPI (per token) · 1 caveat | $1.25 / $2.50 | $1.56$0.156/taskcache: Cached input $0 | — | — | srcDIRECTread 2026-09-07 |
|---|
| 21 | Moonshot AI Kimi K2.7 Code / K2.7-highspeed / K2.6 (API)Cache-hit rates differ - see notesAPI (per token) · 1 caveat | $0.95 / $4.00 | $1.71$0.171/taskcache: Cache-hit $0 | — | 29* | srcDIRECTread 2026-09-07 |
|---|
| 22 | Anthropic Haiku 4.5API (per token) · 0 caveats | $1.00 / $5.00 | $2.00$0.200/taskcache: 0 | — | 18 | srcDIRECTread 2026-09-07 |
|---|
| 23 | Z.ai GLM-5.3 / GLM-5.2 / GLM-5.1Context windows unpublishedAPI (per token) · 1 caveat | $1.40 / $4.40 | $2.15$0.215/taskcache: Cached input $0 | — | 44 | srcDIRECTread 2026-09-07 |
|---|
| 24 | DeepInfra / Hyperbolic / Novita / Lambda Third-party hosting (observed, not rowed)Unverified third-party figureCredits / prepaid · 1 caveat | $1.74 / $3.48 | $2.17$0.217/task | — | 36 | srcUNCERTAINread 2026-09-07 |
|---|
| 25 | xAI grok-4.6Whole-request repricing above 200kAPI (per token) · 1 caveat | $2.00 / $6.00 | $3.00$0.300/taskcache: Cached input $0 | — | 44 | srcDIRECTread 2026-09-07 |
|---|
| 26 | xAI grok-4.5Whole-request repricing above 200kAPI (per token) · 1 caveat | $2.00 / $6.00 | $3.00$0.300/taskcache: Cached input $0 | — | — | srcDIRECTread 2026-09-07 |
|---|
| 27 | Alibaba (Qwen) Qwen official API (Model Studio)Region/term tiers - see notesAPI (per token) · 1 caveat | $2.00 / $6.00 | $3.00$0.300/taskcache: 10% of input price, i | — | 45* | srcDIRECTread 2026-09-07 |
|---|
| 28 | Alibaba (Qwen) via Together AI Qwen3.8-2.4T-A95B / Qwen3.8 Flash / Qwen3.7-Max / Qwen3.7-PlusResale pricing, not first-partyAPI (per token) · 1 caveat | $2.00 / $6.00 | $3.00$0.300/taskcache: Cached input shown per model (e | — | 40 | srcDIRECTread 2026-09-07 |
|---|
| 29 | Google Gemini 3.5 Flash / 3.5 Flash-LiteTwo models on one rowAPI (per token) · 1 caveat | $1.50 / $9.00 | $3.38$0.338/taskcache: Cached input $0 | — | — | srcDIRECTread 2026-09-07 |
|---|
| 30 | Google Gemini 2.5 ProLong-context surcharge above 200kAPI (per token) · 1 caveat | $1.25 / $10.00 | $3.44$0.344/taskcache: Cached input $0 | $1.72~$0.172/task | 17 | srcDIRECTread 2026-09-07 |
|---|
| 31 | OpenAI o-series (o3 / o3-pro / o4-mini / o1 / o1-pro)Five models on one rowAPI (per token) · 1 caveat | $2.00 / $8.00 | $3.50$0.350/taskcache: Differs by model: o3 75% off | $1.75~$0.175/task | 20* | srcDIRECTread 2026-09-07 |
|---|
| 32 | OpenAI gpt-4.1 / 4.1-mini / 4.1-nanoThree models on one rowAPI (per token) · 1 caveat | $2.00 / $8.00 | $3.50$0.350/taskcache: 75% off cached input | $1.75~$0.175/task | — | srcDIRECTread 2026-09-07 |
|---|
| 33 | Anthropic Sonnet 5API (per token) · 0 caveats | $2.00 / $10.00 | $4.00$0.400/taskcache: 0 | — | 38 | srcDIRECTread 2026-09-07 |
|---|
| 34 | OpenAI gpt-5.6-terraAPI (per token) · 0 caveats | $2.00 / $12.00 | $4.50$0.450/taskcache: 0 | $2.25~$0.225/task | 42 | srcDIRECTread 2026-09-07 |
|---|
| 35 | Google Gemini 3.1 Pro PreviewLong-context surcharge above 200k · No free tierAPI (per token) · 2 caveats | $2.00 / $12.00 | $4.50$0.450/taskcache: Cached input $0 | — | — | srcDIRECTread 2026-09-07 |
|---|
| 36 | OpenAI gpt-5.2 / gpt-5.1Two models on one rowAPI (per token) · 1 caveat | $1.75 / $14.00 | $4.81$0.481/taskcache: 90% off cached input | $2.41~$0.241/task | — | srcDIRECTread 2026-09-07 |
|---|
| 37 | Moonshot AI kimi-k3 (API)Taxes excludedAPI (per token) · 1 caveat | $3.00 / $15.00 | $6.00$0.600/taskcache: Cache-hit input $0 | — | 44 | srcDIRECTread 2026-09-07 |
|---|
| 38 | OpenAI gpt-5.6-solPromo expiry 2026-11-21API (per token) · 1 caveat | $4.00 / $20.00 | $8.00$0.800/taskcache: 0 | $4.00~$0.400/task | 47 | srcDIRECTread 2026-09-07 |
|---|
| 39 | Anthropic Opus 5API (per token) · 0 caveats | $5.00 / $25.00 | $10.00$1.000/taskcache: 0 | — | 51 | srcDIRECTread 2026-09-07 |
|---|
| 40 | OpenAI gpt-5.5 / 5.4 / 5.4-mini / 5.4-nanoLadder row; models not splitAPI (per token) · 1 caveat | $5.00 / $30.00 | $11.25$1.125/taskcache: 90% off cached input (pro variants: no cached rate published) | $5.63~$0.563/task | 27 | srcDIRECTread 2026-09-07 |
|---|
| 41 | Anthropic Fable 5.1High output rateAPI (per token) · 1 caveat | $10.00 / $50.00 | $20.00$2.000/taskcache: 0 | $10.00~$1.000/task | 53 | srcDIRECTread 2026-09-07 |
|---|
| 42 | OpenAI gpt-6-astra (newest flagship)Newest flagship; premium rateAPI (per token) · 1 caveat | $10.00 / $50.00 | $20.00$2.000/taskcache: 0 | $10.00~$1.000/task | 53 | srcDIRECTread 2026-09-07 |
|---|
| 43 | OpenAI gpt-5-pro / 5.2-pro / 5.5-proThree models on one row; no cache rateAPI (per token) · 1 caveat | $15.00 / $120.00 | $41.25$4.125/taskcache: not published (no cached rate in table) | $20.63~$2.063/task | — | srcDIRECTread 2026-09-07 |
|---|