Turning unstructured text into JSON: invoices, tickets, leads, moderation labels. Structured input in, compact structured output.
Input / request
2,000
Output / request
250
Cacheable input
20%
Requests / user / day
200
Cost by model
| Model | Per request | Per user / month | 500 users / month | vs cheapest |
|---|---|---|---|---|
| bestGLM-4.7-Flash (Z.ai) | Free | Free | Free | — |
| GLM-4.5-Flash (Z.ai) | Free | Free | Free | Not comparable |
| GLM-4.6V-Flash (Z.ai) | Free | Free | Free | Not comparable |
| OpenRouter Free Tier (Llama 3.3) | Free | Free | Free | Not comparable |
| Ox Alpha (Z.ai GLM preview) | Free | Free | Free | Not comparable |
| Text Embedding 3 (Small) | $0.000040 | $0.24 | $120.00 | Not comparable |
| Text Embedding 004 | $0.000040 | $0.24 | $120.00 | Not comparable |
| Llama 3.2 3B Instruct | $0.000073 | $0.435 | $217.50 | Not comparable |
| Amazon Nova Micro | $0.000095 | $0.567 | $283.50 | Not comparable |
| Llama 3.2 1B Instruct (OpenRouter) | $0.000104 | $0.6255 | $312.75 | Not comparable |
| Llama 3.1 8B Instruct | $0.00012 | $0.72 | $360.00 | Not comparable |
| Groq LPU — Llama 3.1 8B Instant | $0.00012 | $0.72 | $360.00 | Not comparable |
| Qwen 2.5 Turbo | $0.000132 | $0.792 | $396.00 | Not comparable |
| Cohere Command R7B | $0.000138 | $0.825 | $412.50 | Not comparable |
| Together AI — GPT-OSS-20B | $0.00015 | $0.90 | $450.00 | Not comparable |
| Amazon Nova Lite | $0.000162 | $0.972 | $486.00 | Not comparable |
| GLM-4.6V-FlashX (Z.ai) | $0.000166 | $0.9936 | $496.80 | Not comparable |
| GLM-5.3-Flash (Z.ai) | $0.000189 | $1.131 | $565.50 | Not comparable |
| Mistral Small 3.2 24B (OpenRouter) | $0.0002 | $1.20 | $600.00 | Not comparable |
| Gemini 2.0 Flash-Lite | $0.000203 | $1.215 | $607.50 | Not comparable |
| Gemini 1.5 Flash | $0.000203 | $1.215 | $607.50 | Not comparable |
| GLM-4.7-FlashX (Z.ai) | $0.000216 | $1.296 | $648.00 | Not comparable |
| DeepInfra — Qwen 2.5 Coder 32B | $0.00022 | $1.32 | $660.00 | Not comparable |
| Hy-MT2-30B-A3B (OpenRouter) | $0.000222 | $1.331 | $665.25 | Not comparable |
| GLM-4-32B-0414-128K (Z.ai) | $0.000225 | $1.35 | $675.00 | Not comparable |
| Muse Spark 1.2 Contributor (OpenRouter) | $0.00025 | $1.50 | $750.00 | Not comparable |
| Text Embedding 3 (Large) | $0.00026 | $1.56 | $780.00 | Not comparable |
| Gemini 2.5 Flash-Lite | $0.00027 | $1.62 | $810.00 | Not comparable |
| Gemini 2.0 Flash | $0.00027 | $1.62 | $810.00 | Not comparable |
| Microsoft Phi-4 (14B) | $0.000275 | $1.65 | $825.00 | Not comparable |
| DeepInfra — Llama 3.3 70B | $0.000275 | $1.65 | $825.00 | Not comparable |
| Groq LPU — Llama 4 Scout | $0.000283 | $1.698 | $849.00 | Not comparable |
| Ministral 3 8B | $0.000284 | $1.701 | $850.50 | Not comparable |
| Fireworks AI — Llama 4 Scout | $0.000294 | $1.764 | $882.00 | Not comparable |
| DeepSeek V3 (Chat) | $0.0003 | $1.798 | $898.80 | Not comparable |
| DeepSeek Coder V2.5 | $0.0003 | $1.798 | $898.80 | Not comparable |
| Yi-Lightning (01.AI) | $0.000315 | $1.89 | $945.00 | Not comparable |
| Llama 3.2 11B Vision | $0.00036 | $2.16 | $1,080.00 | Not comparable |
| Ministral 3 14B | $0.000378 | $2.268 | $1,134.00 | Not comparable |
| Mistral Small 4 | $0.000396 | $2.376 | $1,188.00 | Not comparable |
| Llama 4 Scout (109B MoE) | $0.000413 | $2.475 | $1,237.50 | Not comparable |
| GPT-4o mini | $0.00042 | $2.52 | $1,260.00 | Not comparable |
| Qwen3 Coder Next (OpenRouter) | $0.00042 | $2.52 | $1,260.00 | Not comparable |
| Qwen3.8-Flash (QwenCloud preview) | $0.000438 | $2.625 | $1,312.50 | Not comparable |
| Cohere Command R | $0.00045 | $2.70 | $1,350.00 | Not comparable |
| Microsoft Phi-3.5 MoE | $0.00045 | $2.70 | $1,350.00 | Not comparable |
| Gemma 2 9B Instruct | $0.00045 | $2.70 | $1,350.00 | Not comparable |
| Grok 4.1 Fast | $0.000461 | $2.766 | $1,383.00 | Not comparable |
| Qwen 2.5 Coder 32B | $0.000478 | $2.868 | $1,434.00 | Not comparable |
| AI21 Jamba 1.5 Mini | $0.0005 | $3.00 | $1,500.00 | Not comparable |
| Llama 3.3 70B Instruct | $0.000508 | $3.045 | $1,522.50 | Not comparable |
| Groq LPU — Llama 4 Maverick | $0.00051 | $3.06 | $1,530.00 | Not comparable |
| DeepSeek V3.2 (OpenRouter) | $0.000563 | $3.378 | $1,689.00 | Not comparable |
| Qwen3 Coder Flash (OpenRouter) | $0.000571 | $3.428 | $1,714.05 | Not comparable |
| GLM-4.5-Air (Z.ai) | $0.000607 | $3.642 | $1,821.00 | Not comparable |
| MiniMax-01 (4M Context) | $0.000611 | $3.666 | $1,833.00 | Not comparable |
| GPT-5.6 Luna | $0.000628 | $3.768 | $1,884.00 | Not comparable |
| GPT-5.6 Luna Pro (OpenRouter) | $0.000628 | $3.768 | $1,884.00 | Not comparable |
| GPT-5.4 nano | $0.000641 | $3.843 | $1,921.50 | Not comparable |
| Groq LPU — QwQ 32B Reasoner | $0.000678 | $4.065 | $2,032.50 | Not comparable |
| Gemma 4 31B Instruct | $0.000688 | $4.125 | $2,062.50 | Not comparable |
| Codestral 2501 | $0.000717 | $4.302 | $2,151.00 | Not comparable |
| Codestral 2508 (OpenRouter) | $0.000717 | $4.302 | $2,151.00 | Not comparable |
| Claude 3 Haiku | $0.000722 | $4.335 | $2,167.50 | Not comparable |
| GLM-4.6V (Z.ai) | $0.000725 | $4.35 | $2,175.00 | Not comparable |
| Qwen 2.5 72B Instruct | $0.000749 | $4.494 | $2,247.00 | Not comparable |
| Gemini 3.1 Flash Lite (OpenRouter) | $0.000785 | $4.71 | $2,355.00 | Not comparable |
| MiniMax M2.7 (OpenRouter) | $0.000804 | $4.824 | $2,412.00 | Not comparable |
| MiniMax M3 (OpenRouter) | $0.000804 | $4.824 | $2,412.00 | Not comparable |
| Qwen 3 32B Instruct | $0.000856 | $5.136 | $2,568.00 | Not comparable |
| NVIDIA Llama 3.1 Nemotron 70B | $0.000875 | $5.25 | $2,625.00 | Not comparable |
| Cerebras — GPT OSS 120B | $0.000887 | $5.325 | $2,662.50 | Not comparable |
| Llama 3.1 70B Instruct (OpenRouter) | $0.0009 | $5.40 | $2,700.00 | Not comparable |
| Together AI — Llama 4 Maverick | $0.000925 | $5.55 | $2,775.00 | Not comparable |
| QwQ 32B (Reasoner) | $0.000956 | $5.736 | $2,868.00 | Not comparable |
| Cerebras — Qwen 3 32B | $0.001 | $6.00 | $3,000.00 | Not comparable |
| DeepSeek V4 Flash | $0.00104 | $6.238 | $3,118.80 | Not comparable |
| DeepSeek V4 Flash Vision Exp | $0.00104 | $6.238 | $3,118.80 | Not comparable |
| Gemini 3.5 Flash-Lite | $0.001117 | $6.702 | $3,351.00 | Not comparable |
| Gemini 2.5 Flash | $0.001135 | $6.81 | $3,405.00 | Not comparable |
| Mistral Large 3 | $0.001195 | $7.17 | $3,585.00 | Not comparable |
| Llama 4 Maverick (400B MoE) | $0.001213 | $7.275 | $3,637.50 | Not comparable |
| Devstral 2 (2512) (OpenRouter) | $0.001272 | $7.63 | $3,814.80 | Not comparable |
| Qwen3.5 397B A17B (OpenRouter) | $0.001365 | $8.19 | $4,095.00 | Not comparable |
| GPT-3.5 Turbo | $0.001375 | $8.25 | $4,125.00 | Not comparable |
| Together AI — DeepSeek V4 | $0.001375 | $8.25 | $4,125.00 | Not comparable |
| Groq LPU — Llama 3.3 70B | $0.001378 | $8.265 | $4,132.50 | Not comparable |
| GLM-4.5V (Z.ai) | $0.001454 | $8.724 | $4,362.00 | Not comparable |
| DeepSeek R1 (Reasoner) | $0.001484 | $8.901 | $4,450.50 | Not comparable |
| GLM-4.6 (Z.ai) | $0.001554 | $9.324 | $4,662.00 | Not comparable |
| GLM-4.5 (Z.ai) | $0.001554 | $9.324 | $4,662.00 | Not comparable |
| GLM 4.7 (Zhipu) | $0.001554 | $9.324 | $4,662.00 | Not comparable |
| Qwen3.8 27B (OpenRouter) | $0.00159 | $9.54 | $4,770.00 | Not comparable |
| Fireworks AI — DeepSeek R1 | $0.001648 | $9.885 | $4,942.50 | Not comparable |
| Databricks DBRX Instruct | $0.00165 | $9.90 | $4,950.00 | Not comparable |
| Qwen3 VL 235B Thinking (OpenRouter) | $0.0018 | $10.80 | $5,400.00 | Not comparable |
| Kimi K2.7 Code (OpenRouter) | $0.001998 | $11.988 | $5,994.00 | Not comparable |
| Llama 3.2 90B Vision | $0.002025 | $12.15 | $6,075.00 | Not comparable |
| Amazon Nova Pro | $0.00216 | $12.96 | $6,480.00 | Not comparable |
| Grok Build 0.1 | $0.00218 | $13.08 | $6,540.00 | Not comparable |
| Perplexity Sonar | $0.00225 | $13.50 | $6,750.00 | Not comparable |
| Claude 3.5 Haiku | $0.002312 | $13.872 | $6,936.00 | Not comparable |
| Cerebras — Gemma 4 31B | $0.002353 | $14.115 | $7,057.50 | Not comparable |
| GPT-5.4 mini | $0.002355 | $14.13 | $7,065.00 | Not comparable |
| GLM-5 (Z.ai) | $0.00248 | $14.88 | $7,440.00 | Not comparable |
| Grok 4.3 | $0.002705 | $16.23 | $8,115.00 | Not comparable |
| OpenRouter Auto-Best Router | $0.00275 | $16.50 | $8,250.00 | Not comparable |
| Claude Haiku 4.5 | $0.00289 | $17.34 | $8,670.00 | Not comparable |
| o4-mini | $0.00297 | $17.82 | $8,910.00 | Not comparable |
| GLM-4.5-AirX (Z.ai) | $0.002973 | $17.838 | $8,919.00 | Not comparable |
| GLM-5-Turbo (Z.ai) | $0.003016 | $18.096 | $9,048.00 | Not comparable |
| GLM-5V-Turbo (Z.ai) | $0.003016 | $18.096 | $9,048.00 | Not comparable |
| o3-mini | $0.00308 | $18.48 | $9,240.00 | Not comparable |
| o1-mini | $0.00308 | $18.48 | $9,240.00 | Not comparable |
| DeepSeek V4 Pro | $0.00312 | $18.718 | $9,358.80 | Not comparable |
| Gemini 1.5 Pro | $0.003375 | $20.25 | $10,125.00 | Not comparable |
| GLM-5.3 (Z.ai) | $0.003444 | $20.664 | $10,332.00 | Not comparable |
| GLM-5.2 (Z.ai) | $0.003444 | $20.664 | $10,332.00 | Not comparable |
| GLM-5.1 (Z.ai) | $0.003444 | $20.664 | $10,332.00 | Not comparable |
| NVIDIA Nemotron-4 340B | $0.00375 | $22.50 | $11,250.00 | Not comparable |
| Gemini 3.7 Flash | $0.00396 | $23.76 | $11,880.00 | Not comparable |
| Kimi K2.6 | $0.00396 | $23.76 | $11,880.00 | Not comparable |
| Qwen 2.5 Max | $0.004224 | $25.344 | $12,672.00 | Not comparable |
| Gemini 3.6 Flash | $0.004335 | $26.01 | $13,005.00 | Not comparable |
| Mistral Medium 3.5 | $0.004335 | $26.01 | $13,005.00 | Not comparable |
| Llama 3.1 405B Instruct | $0.004375 | $26.25 | $13,125.00 | Not comparable |
| Gemini 2.5 Pro | $0.004625 | $27.75 | $13,875.00 | Not comparable |
| Gemini 3.5 Flash (OpenRouter) | $0.00471 | $28.26 | $14,130.00 | Not comparable |
| Pixtral Large | $0.00478 | $28.68 | $14,340.00 | Not comparable |
| Mistral Large 2 (2411) | $0.00478 | $28.68 | $14,340.00 | Not comparable |
| Qwen 3.8 Max (2.4T MoE) | $0.00478 | $28.68 | $14,340.00 | Not comparable |
| Grok 4.5 | $0.00482 | $28.92 | $14,460.00 | Not comparable |
| Grok 4.6 Flagship | $0.0049 | $29.40 | $14,700.00 | Not comparable |
| Amazon Nova Premier | $0.00528 | $31.68 | $15,840.00 | Not comparable |
| Claude Sonnet 5 | $0.00578 | $34.68 | $17,340.00 | Not comparable |
| GPT-5.6 Sol Pro (OpenRouter) | $0.00578 | $34.68 | $17,340.00 | Not comparable |
| GLM-4.5-X (Z.ai) | $0.005925 | $35.55 | $17,775.00 | Not comparable |
| Perplexity Sonar Reasoning Pro | $0.006 | $36.00 | $18,000.00 | Not comparable |
| Perplexity Sonar Deep Research | $0.006 | $36.00 | $18,000.00 | Not comparable |
| AI21 Jamba 1.5 Large | $0.006 | $36.00 | $18,000.00 | Not comparable |
| GPT-5.6 Terra | $0.00628 | $37.68 | $18,840.00 | Not comparable |
| Gemini 3.1 Pro | $0.00628 | $37.68 | $18,840.00 | Not comparable |
| GPT-5.6 Terra Pro (OpenRouter) | $0.00628 | $37.68 | $18,840.00 | Not comparable |
| GPT-5.3 Codex | $0.00637 | $38.22 | $19,110.00 | Not comparable |
| Grok 2 | $0.0065 | $39.00 | $19,500.00 | Not comparable |
| Grok 2 Vision | $0.0065 | $39.00 | $19,500.00 | Not comparable |
| Cohere Command A+ | $0.0066 | $39.60 | $19,800.00 | Not comparable |
| GPT-4o (Omni) | $0.007 | $42.00 | $21,000.00 | Not comparable |
| Cohere Command R+ | $0.0075 | $45.00 | $22,500.00 | Not comparable |
| GPT-5.4 Workhorse | $0.00785 | $47.10 | $23,550.00 | Not comparable |
| Claude 3.7 Sonnet (Hybrid Reasoning) | $0.00867 | $52.02 | $26,010.00 | Not comparable |
| Claude 3.5 Sonnet | $0.00867 | $52.02 | $26,010.00 | Not comparable |
| Kimi K3 (Moonshot) | $0.00867 | $52.02 | $26,010.00 | Not comparable |
| Claude Sonnet 4.6 (OpenRouter) | $0.00867 | $52.02 | $26,010.00 | Not comparable |
| Perplexity Sonar Pro | $0.00975 | $58.50 | $29,250.00 | Not comparable |
| Claude Opus 5 | $0.0145 | $86.70 | $43,350.00 | Not comparable |
| Claude Opus 4.8 (OpenRouter) | $0.0145 | $86.70 | $43,350.00 | Not comparable |
| GPT-5.6 Sol | $0.0157 | $94.20 | $47,100.00 | Not comparable |
| GPT-5.5 Standard | $0.0157 | $94.20 | $47,100.00 | Not comparable |
| GPT-4 Turbo | $0.0255 | $153.00 | $76,500.00 | Not comparable |
| o3 (Reasoning Frontier) | $0.0264 | $158.40 | $79,200.00 | Not comparable |
| Claude Fable 5 | $0.0289 | $173.40 | $86,700.00 | Not comparable |
| GPT-5.6 Cyber | $0.0393 | $235.50 | $117,750.00 | Not comparable |
| o1 (Reasoning) | $0.042 | $252.00 | $126,000.00 | Not comparable |
| Claude 3 Opus | $0.0434 | $260.10 | $130,050.00 | Not comparable |
| o3-pro (Frontier Reasoning) | $0.0528 | $316.80 | $158,400.00 | Not comparable |
| GPT-5.5 Pro | $0.0942 | $565.20 | $282,600.00 | Not comparable |
Assumes the typical cacheable share (20% of input at cached rates where published). 200 requests/user/day. Adjust everything in the monthly calculator.
Best value picks for Data extraction & tagging
| Model | Fit score | Cost / 1K requests | Value (fit ÷ cost) |
|---|---|---|---|
| best valueGLM-5.3-Flash (Z.ai) | 63.2 | $0.1885 | 335.3 |
| GPT-5.6 Luna | 58.9 | $0.628 | 93.8 |
| DeepSeek V3.2 (OpenRouter) | 44.2 | $0.563 | 78.5 |
| GPT-5.4 nano | 44.3 | $0.6405 | 69.2 |
| MiniMax M3 (OpenRouter) | 48.8 | $0.804 | 60.7 |
Fit = weighted blend of third-party composite indices (intelligence, coding, agentic) for this use case; value = fit ÷ cost per 1,000 requests. Models without a verified composite are excluded. Methodology · Benchmark hub.
How to spend less
Related workflow costs
FAQ
Using a typical profile of 2,000 input and 250 output tokens with 20% cacheable input: from Free on GLM-4.7-Flash (Z.ai) up to $0.0942 on GPT-5.5 Pro. See the table for every model.
At 200 requests per user per day and the typical token profile, budget from Free per active user per month on GLM-4.7-Flash (Z.ai). A team of 500 active users lands around Free/month at that tier. Model your exact numbers in the monthly cost calculator.
Volume makes nano-tier models attractive — extraction rarely needs frontier reasoning. Constrain output with JSON schema modes to avoid retry loops on malformed responses. Cache shared schema instructions and few-shot examples across calls.