Marketing copy, product descriptions, emails and SEO drafts: short instruction input, long creative output.
Input / request
800
Output / request
1,200
Cacheable input
30%
Requests / user / day
20
Cost by model
| Model | Per request | Per user / month | 500 users / month | vs cheapest |
|---|---|---|---|---|
| bestGLM-4.7-Flash (Z.ai) | Free | Free | Free | — |
| GLM-4.5-Flash (Z.ai) | Free | Free | Free | Not comparable |
| GLM-4.6V-Flash (Z.ai) | Free | Free | Free | Not comparable |
| OpenRouter Free Tier (Llama 3.3) | Free | Free | Free | Not comparable |
| Ox Alpha (Z.ai GLM preview) | Free | Free | Free | Not comparable |
| Text Embedding 3 (Small) | $0.000016 | $0.0096 | $4.80 | Not comparable |
| Text Embedding 004 | $0.000016 | $0.0096 | $4.80 | Not comparable |
| Llama 3.2 3B Instruct | $0.000084 | $0.0504 | $25.20 | Not comparable |
| Text Embedding 3 (Large) | $0.000104 | $0.0624 | $31.20 | Not comparable |
| Llama 3.1 8B Instruct | $0.000136 | $0.0816 | $40.80 | Not comparable |
| Groq LPU — Llama 3.1 8B Instant | $0.000136 | $0.0816 | $40.80 | Not comparable |
| Amazon Nova Micro | $0.00019 | $0.1138 | $56.91 | Not comparable |
| GLM-4-32B-0414-128K (Z.ai) | $0.0002 | $0.12 | $60.00 | Not comparable |
| Cohere Command R7B | $0.00022 | $0.132 | $66.00 | Not comparable |
| Llama 3.2 1B Instruct (OpenRouter) | $0.000263 | $0.1577 | $78.84 | Not comparable |
| Ministral 3 8B | $0.000268 | $0.1606 | $80.28 | Not comparable |
| Qwen 2.5 Turbo | $0.000269 | $0.1615 | $80.76 | Not comparable |
| Together AI — GPT-OSS-20B | $0.00028 | $0.168 | $84.00 | Not comparable |
| Yi-Lightning (01.AI) | $0.00028 | $0.168 | $84.00 | Not comparable |
| Mistral Small 3.2 24B (OpenRouter) | $0.0003 | $0.18 | $90.00 | Not comparable |
| Llama 3.2 11B Vision | $0.00032 | $0.192 | $96.00 | Not comparable |
| Muse Spark 1.2 Contributor (OpenRouter) | $0.00032 | $0.192 | $96.00 | Not comparable |
| Amazon Nova Lite | $0.000325 | $0.1951 | $97.56 | Not comparable |
| GLM-5.3-Flash (Z.ai) | $0.000346 | $0.2074 | $103.68 | Not comparable |
| DeepInfra — Qwen 2.5 Coder 32B | $0.000352 | $0.2112 | $105.60 | Not comparable |
| Ministral 3 14B | $0.000357 | $0.2141 | $107.04 | Not comparable |
| Gemma 2 9B Instruct | $0.0004 | $0.24 | $120.00 | Not comparable |
| Gemini 2.0 Flash-Lite | $0.000406 | $0.2439 | $121.95 | Not comparable |
| Gemini 1.5 Flash | $0.000406 | $0.2439 | $121.95 | Not comparable |
| Hy-MT2-30B-A3B (OpenRouter) | $0.000413 | $0.2479 | $123.96 | Not comparable |
| DeepSeek V3 (Chat) | $0.000418 | $0.2507 | $125.328 | Not comparable |
| DeepSeek Coder V2.5 | $0.000418 | $0.2507 | $125.328 | Not comparable |
| Microsoft Phi-4 (14B) | $0.00044 | $0.264 | $132.00 | Not comparable |
| DeepInfra — Llama 3.3 70B | $0.00044 | $0.264 | $132.00 | Not comparable |
| Groq LPU — Llama 4 Scout | $0.000483 | $0.2897 | $144.84 | Not comparable |
| GLM-4.6V-FlashX (Z.ai) | $0.000503 | $0.302 | $151.008 | Not comparable |
| Fireworks AI — Llama 4 Scout | $0.000506 | $0.3038 | $151.92 | Not comparable |
| GLM-4.7-FlashX (Z.ai) | $0.000522 | $0.313 | $156.48 | Not comparable |
| Gemini 2.5 Flash-Lite | $0.000542 | $0.3252 | $162.60 | Not comparable |
| Gemini 2.0 Flash | $0.000542 | $0.3252 | $162.60 | Not comparable |
| DeepSeek V3.2 (OpenRouter) | $0.000633 | $0.3797 | $189.84 | Not comparable |
| AI21 Jamba 1.5 Mini | $0.00064 | $0.384 | $192.00 | Not comparable |
| Llama 4 Scout (109B MoE) | $0.00066 | $0.396 | $198.00 | Not comparable |
| Qwen3.8-Flash (QwenCloud preview) | $0.000692 | $0.4152 | $207.60 | Not comparable |
| Groq LPU — QwQ 32B Reasoner | $0.0007 | $0.42 | $210.00 | Not comparable |
| Grok 4.1 Fast | $0.000722 | $0.433 | $216.48 | Not comparable |
| Llama 3.1 70B Instruct (OpenRouter) | $0.0008 | $0.48 | $240.00 | Not comparable |
| Mistral Small 4 | $0.000808 | $0.4846 | $242.28 | Not comparable |
| GPT-4o mini | $0.000822 | $0.4932 | $246.60 | Not comparable |
| Qwen 2.5 Coder 32B | $0.000837 | $0.5021 | $251.04 | Not comparable |
| Cohere Command R | $0.00084 | $0.504 | $252.00 | Not comparable |
| Microsoft Phi-3.5 MoE | $0.00084 | $0.504 | $252.00 | Not comparable |
| Llama 3.3 70B Instruct | $0.000852 | $0.5112 | $255.60 | Not comparable |
| Groq LPU — Llama 4 Maverick | $0.000856 | $0.5136 | $256.80 | Not comparable |
| Qwen3 Coder Next (OpenRouter) | $0.001044 | $0.6264 | $313.20 | Not comparable |
| Qwen 2.5 72B Instruct | $0.001044 | $0.6266 | $313.32 | Not comparable |
| Gemma 4 31B Instruct | $0.0011 | $0.66 | $330.00 | Not comparable |
| NVIDIA Llama 3.1 Nemotron 70B | $0.00112 | $0.672 | $336.00 | Not comparable |
| Cerebras — GPT OSS 120B | $0.00118 | $0.708 | $354.00 | Not comparable |
| Qwen 3 32B Instruct | $0.001194 | $0.7162 | $358.08 | Not comparable |
| Codestral 2501 | $0.001255 | $0.7531 | $376.56 | Not comparable |
| Codestral 2508 (OpenRouter) | $0.001255 | $0.7531 | $376.56 | Not comparable |
| GLM-4.6V (Z.ai) | $0.00126 | $0.756 | $378.00 | Not comparable |
| Cerebras — Qwen 3 32B | $0.00128 | $0.768 | $384.00 | Not comparable |
| Qwen3 Coder Flash (OpenRouter) | $0.001289 | $0.7731 | $386.568 | Not comparable |
| Together AI — Llama 4 Maverick | $0.00136 | $0.816 | $408.00 | Not comparable |
| Groq LPU — Llama 3.3 70B | $0.00142 | $0.852 | $426.00 | Not comparable |
| GLM-4.5-Air (Z.ai) | $0.001439 | $0.8635 | $431.76 | Not comparable |
| MiniMax-01 (4M Context) | $0.001442 | $0.865 | $432.48 | Not comparable |
| GPT-5.6 Luna | $0.001557 | $0.9341 | $467.04 | Not comparable |
| GPT-5.6 Luna Pro (OpenRouter) | $0.001557 | $0.9341 | $467.04 | Not comparable |
| GPT-5.4 nano | $0.001617 | $0.9701 | $485.04 | Not comparable |
| MiniMax M2.7 (OpenRouter) | $0.001622 | $0.9734 | $486.72 | Not comparable |
| MiniMax M3 (OpenRouter) | $0.001622 | $0.9734 | $486.72 | Not comparable |
| Claude 3 Haiku | $0.001646 | $0.9876 | $493.80 | Not comparable |
| QwQ 32B (Reasoner) | $0.001674 | $1.004 | $502.08 | Not comparable |
| Llama 3.2 90B Vision | $0.0018 | $1.08 | $540.00 | Not comparable |
| DeepSeek V4 Flash | $0.001834 | $1.10 | $550.128 | Not comparable |
| DeepSeek V4 Flash Vision Exp | $0.001834 | $1.10 | $550.128 | Not comparable |
| Llama 4 Maverick (400B MoE) | $0.00186 | $1.116 | $558.00 | Not comparable |
| Gemini 3.1 Flash Lite (OpenRouter) | $0.001946 | $1.168 | $583.80 | Not comparable |
| Perplexity Sonar | $0.002 | $1.20 | $600.00 | Not comparable |
| Mistral Large 3 | $0.002092 | $1.255 | $627.60 | Not comparable |
| GPT-3.5 Turbo | $0.0022 | $1.32 | $660.00 | Not comparable |
| Together AI — DeepSeek V4 | $0.0022 | $1.32 | $660.00 | Not comparable |
| GLM-4.5V (Z.ai) | $0.002522 | $1.513 | $756.72 | Not comparable |
| Cerebras — Gemma 4 31B | $0.00258 | $1.548 | $774.00 | Not comparable |
| Databricks DBRX Instruct | $0.00264 | $1.584 | $792.00 | Not comparable |
| Devstral 2 (2512) (OpenRouter) | $0.002897 | $1.738 | $869.088 | Not comparable |
| DeepSeek R1 (Reasoner) | $0.00297 | $1.782 | $890.88 | Not comparable |
| GLM-4.6 (Z.ai) | $0.003002 | $1.801 | $900.72 | Not comparable |
| GLM-4.5 (Z.ai) | $0.003002 | $1.801 | $900.72 | Not comparable |
| GLM 4.7 (Zhipu) | $0.003002 | $1.801 | $900.72 | Not comparable |
| Grok Build 0.1 | $0.003008 | $1.805 | $902.40 | Not comparable |
| Fireworks AI — DeepSeek R1 | $0.003068 | $1.841 | $920.40 | Not comparable |
| Qwen3.5 397B A17B (OpenRouter) | $0.00312 | $1.872 | $936.00 | Not comparable |
| Gemini 3.5 Flash-Lite | $0.003175 | $1.905 | $952.56 | Not comparable |
| Gemini 2.5 Flash | $0.003186 | $1.912 | $955.80 | Not comparable |
| Grok 4.3 | $0.003748 | $2.249 | $1,124.40 | Not comparable |
| Qwen3.8 27B (OpenRouter) | $0.003936 | $2.362 | $1,180.80 | Not comparable |
| Amazon Nova Pro | $0.004336 | $2.602 | $1,300.80 | Not comparable |
| OpenRouter Auto-Best Router | $0.0044 | $2.64 | $1,320.00 | Not comparable |
| GLM-5 (Z.ai) | $0.004448 | $2.669 | $1,334.40 | Not comparable |
| Kimi K2.7 Code (OpenRouter) | $0.004501 | $2.70 | $1,350.24 | Not comparable |
| NVIDIA Nemotron-4 340B | $0.0048 | $2.88 | $1,440.00 | Not comparable |
| Qwen3 VL 235B Thinking (OpenRouter) | $0.00512 | $3.072 | $1,536.00 | Not comparable |
| Claude 3.5 Haiku | $0.005267 | $3.16 | $1,580.16 | Not comparable |
| DeepSeek V4 Pro | $0.005502 | $3.301 | $1,650.528 | Not comparable |
| GLM-5-Turbo (Z.ai) | $0.00553 | $3.318 | $1,658.88 | Not comparable |
| GLM-5V-Turbo (Z.ai) | $0.00553 | $3.318 | $1,658.88 | Not comparable |
| Llama 3.1 405B Instruct | $0.0056 | $3.36 | $1,680.00 | Not comparable |
| GPT-5.4 mini | $0.005838 | $3.503 | $1,751.40 | Not comparable |
| o4-mini | $0.005962 | $3.577 | $1,788.60 | Not comparable |
| o3-mini | $0.006028 | $3.617 | $1,808.40 | Not comparable |
| o1-mini | $0.006028 | $3.617 | $1,808.40 | Not comparable |
| GLM-4.5-AirX (Z.ai) | $0.006069 | $3.641 | $1,820.64 | Not comparable |
| GLM-5.3 (Z.ai) | $0.006126 | $3.676 | $1,837.92 | Not comparable |
| GLM-5.2 (Z.ai) | $0.006126 | $3.676 | $1,837.92 | Not comparable |
| GLM-5.1 (Z.ai) | $0.006126 | $3.676 | $1,837.92 | Not comparable |
| Claude Haiku 4.5 | $0.006584 | $3.95 | $1,975.20 | Not comparable |
| Gemini 1.5 Pro | $0.006775 | $4.065 | $2,032.50 | Not comparable |
| Gemini 3.7 Flash | $0.008076 | $4.846 | $2,422.80 | Not comparable |
| Kimi K2.6 | $0.008076 | $4.846 | $2,422.80 | Not comparable |
| Pixtral Large | $0.008368 | $5.021 | $2,510.40 | Not comparable |
| Mistral Large 2 (2411) | $0.008368 | $5.021 | $2,510.40 | Not comparable |
| Qwen 3.8 Max (2.4T MoE) | $0.008368 | $5.021 | $2,510.40 | Not comparable |
| Grok 4.5 | $0.008392 | $5.035 | $2,517.60 | Not comparable |
| Grok 4.6 Flagship | $0.00844 | $5.064 | $2,532.00 | Not comparable |
| Qwen 2.5 Max | $0.008614 | $5.169 | $2,584.32 | Not comparable |
| Gemini 3.6 Flash | $0.009876 | $5.926 | $2,962.80 | Not comparable |
| Mistral Medium 3.5 | $0.009876 | $5.926 | $2,962.80 | Not comparable |
| Amazon Nova Premier | $0.0108 | $6.461 | $3,230.40 | Not comparable |
| Perplexity Sonar Reasoning Pro | $0.0112 | $6.72 | $3,360.00 | Not comparable |
| Perplexity Sonar Deep Research | $0.0112 | $6.72 | $3,360.00 | Not comparable |
| AI21 Jamba 1.5 Large | $0.0112 | $6.72 | $3,360.00 | Not comparable |
| Gemini 3.5 Flash (OpenRouter) | $0.0117 | $7.006 | $3,502.80 | Not comparable |
| GLM-4.5-X (Z.ai) | $0.012 | $7.212 | $3,606.00 | Not comparable |
| Gemini 2.5 Pro | $0.0128 | $7.665 | $3,832.50 | Not comparable |
| Claude Sonnet 5 | $0.0132 | $7.901 | $3,950.40 | Not comparable |
| GPT-5.6 Sol Pro (OpenRouter) | $0.0132 | $7.901 | $3,950.40 | Not comparable |
| Cohere Command A+ | $0.0135 | $8.076 | $4,038.00 | Not comparable |
| Grok 2 | $0.0136 | $8.16 | $4,080.00 | Not comparable |
| Grok 2 Vision | $0.0136 | $8.16 | $4,080.00 | Not comparable |
| GPT-4o (Omni) | $0.0137 | $8.22 | $4,110.00 | Not comparable |
| Cohere Command R+ | $0.014 | $8.40 | $4,200.00 | Not comparable |
| GPT-5.6 Terra | $0.0156 | $9.341 | $4,670.40 | Not comparable |
| Gemini 3.1 Pro | $0.0156 | $9.341 | $4,670.40 | Not comparable |
| GPT-5.6 Terra Pro (OpenRouter) | $0.0156 | $9.341 | $4,670.40 | Not comparable |
| GPT-5.3 Codex | $0.0178 | $10.693 | $5,346.60 | Not comparable |
| GPT-5.4 Workhorse | $0.0195 | $11.676 | $5,838.00 | Not comparable |
| Claude 3.7 Sonnet (Hybrid Reasoning) | $0.0198 | $11.851 | $5,925.60 | Not comparable |
| Claude 3.5 Sonnet | $0.0198 | $11.851 | $5,925.60 | Not comparable |
| Kimi K3 (Moonshot) | $0.0198 | $11.851 | $5,925.60 | Not comparable |
| Claude Sonnet 4.6 (OpenRouter) | $0.0198 | $11.851 | $5,925.60 | Not comparable |
| Perplexity Sonar Pro | $0.0204 | $12.24 | $6,120.00 | Not comparable |
| Claude Opus 5 | $0.0329 | $19.752 | $9,876.00 | Not comparable |
| Claude Opus 4.8 (OpenRouter) | $0.0329 | $19.752 | $9,876.00 | Not comparable |
| GPT-5.6 Sol | $0.0389 | $23.352 | $11,676.00 | Not comparable |
| GPT-5.5 Standard | $0.0389 | $23.352 | $11,676.00 | Not comparable |
| GPT-4 Turbo | $0.0428 | $25.68 | $12,840.00 | Not comparable |
| o3 (Reasoning Frontier) | $0.0538 | $32.304 | $16,152.00 | Not comparable |
| Claude Fable 5 | $0.0658 | $39.504 | $19,752.00 | Not comparable |
| o1 (Reasoning) | $0.0822 | $49.32 | $24,660.00 | Not comparable |
| GPT-5.6 Cyber | $0.0973 | $58.38 | $29,190.00 | Not comparable |
| Claude 3 Opus | $0.0988 | $59.256 | $29,628.00 | Not comparable |
| o3-pro (Frontier Reasoning) | $0.1077 | $64.608 | $32,304.00 | Not comparable |
| GPT-5.5 Pro | $0.2335 | $140.112 | $70,056.00 | Not comparable |
Assumes the typical cacheable share (30% of input at cached rates where published). 20 requests/user/day. Adjust everything in the monthly calculator.
Best value picks for Content generation
| Model | Fit score | Cost / 1K requests | Value (fit ÷ cost) |
|---|---|---|---|
| best valueGLM-5.3-Flash (Z.ai) | 59.1 | $0.3456 | 171.0 |
| DeepSeek V3.2 (OpenRouter) | 44.2 | $0.6328 | 69.8 |
| Llama 3.1 8B Instruct | 5.4 | $0.136 | 39.7 |
| GPT-5.6 Luna | 52.6 | $1.557 | 33.8 |
| DeepSeek V3 (Chat) | 11.7 | $0.4178 | 28.0 |
Fit = weighted blend of third-party composite indices (intelligence, coding, agentic) for this use case; value = fit ÷ cost per 1,000 requests. Models without a verified composite are excluded. Methodology · Benchmark hub.
How to spend less
Related workflow costs
FAQ
Using a typical profile of 800 input and 1,200 output tokens with 30% cacheable input: from Free on GLM-4.7-Flash (Z.ai) up to $0.2335 on GPT-5.5 Pro. See the table for every model.
At 20 requests per user per day and the typical token profile, budget from Free per active user per month on GLM-4.7-Flash (Z.ai). A team of 500 active users lands around Free/month at that tier. Model your exact numbers in the monthly cost calculator.
Output-heavy workloads favor models with a low output price, not a low input price. Batch similar generation tasks with shared style prompts to exploit caching. Draft with a cheap tier, refine the winners with a premium model.