Developer LLM CostingUpdated September 2026

LLM Cost Calculator

Estimate your LLM API expenses with micro-cent precision. Compute cost per request, evaluate prompt caching discounts, and budget multi-agent reasoning workloads.

AI Cost & API Budget Estimator

Prices last updated: 2026-09-11 20:18 UTC

Simulate token bills with prompt caching discounts, batch API pricing, and real-world volume scaling across leading LLMs.

Workload Parameters
Presets:
Tier 1 Quota: 1,000 RPM · 200k TPMModel Specs
tokens
tokens
None (0)

Reasoning models produce hidden deliberation tokens billed at output token rates.

0%
Batch API Mode (50% Off)
24h asynchronous execution discount
Calculated Projection

Claude Sonnet 5

Anthropic
Single Request
$0.0120
$12.00 / 1k reqs
Daily Cost
$12.00
1,000 reqs/day
Monthly (30d)
$360.00
30,000 reqs/mo
Yearly Run-Rate
$4,320.00
Annual projection
Input Tokens (1,500)$0.00450 / req
Output Tokens (500)$0.00750 / req
Total Monthly Volume30,000 requests
Rates verified directly against official API docs.Docs

Workload Cost Comparison Across All Models

Exact cost for 1,500 in + 500 out at 30,000 monthly requests.

Sort by:
ModelProviderPer RequestPer 1,000Monthly (30d)Cache SupportAction
Mistral AI$0.00012$0.1150$3.45Yes
Meta / Open$0.00031$0.3100$9.30No
Google$0.00035$0.3500$10.50Yes
Google$0.00035$0.3500$10.50Yes
DeepSeek$0.00063$0.6300$18.90Yes
OpenAI$0.00090$0.9000$27.00Yes
Mistral AI$0.00150$1.50$45.00Yes
Meta / Open$0.00200$2.00$60.00No
OpenAI$0.00385$3.85$115.50Yes
Anthropic$0.00400$4.00$120.00Yes
OpenAI$0.00623$6.225$186.75Yes
OpenAI$0.00700$7.00$210.00Yes
OpenAI$0.00875$8.75$262.50Yes
Google$0.00900$9.00$270.00Yes
Anthropic$0.0120$12.00$360.00Yes
OpenAI$0.0300$30.00$900.00Yes
Anthropic$0.0400$40.00$1,200.00Yes
Anthropic$0.0600$60.00$1,800.00Yes
OpenAI$0.0700$70.00$2,100.00Yes

How to Choose the Right LLM Cost Tier

Ultra Low-Cost ($0.05 - $0.30 / 1M)
High-volume classification, extraction, routing

Key models: Gemini 2.5 Flash-Lite, GPT-5.6 Luna, Mistral Small 4

Balanced Workhorse ($0.75 - $3.00 / 1M)
Coding agents, full-stack engineering, production RAG

Key models: Claude Sonnet 5, GPT-5.6 Sol, Gemini 3.8 Flash, Llama 4 Scout

Deep Reasoning ($10.00 - $30.00 / 1M)
Complex mathematical proofs, security audits, architecture design

Key models: OpenAI o3, Claude Fable 5.1, o3-pro