{T}
TokenMath.net
Verified against Google Cloud Vertex AI Pricing
GooglebudgetGenerally Available

Gemini 2.5 Flash Token Counter & Cost Calculator

High-throughput sub-second multimodal model with native 1M context at budget rates

Standard Input / 1M
$0.075
Prompt tokens
Cached Input / 1M
$0.019
Prompt caching rate
Output / 1M
$0.30
Generation completion
Context Window
1.05M
Max out: 8.2k
API & Developer Integration Details
generally available
API Model Stringgemini-2.5-flash
Provider & FamilyGoogle (gemma)
Prompt Caching RulesSupported
Long-Context TiersStandard flat rate throughout full window
First-party audit timestamp: 2026-09-15 15:00 UTCOfficial Documentation

Interactive Cost & Token Simulator for Gemini 2.5 Flash

Live Calculation
Input Tokens2,500
Output Tokens800
Requests / Day5,000
Prompt Caching Ratio (50%)$0.01875/M cached rate
Cost / Request$0.00036
Daily Spend (5,000 reqs)$1.7859
Monthly Run-Rate (30d)$53.5781

Standard Workload Cost Scenarios

ScenarioInput TokensOutput TokensUncached CostWith Prompt Caching
Short Chat Query1,000500$0.00022$0.00017
Document Summarization10,0002,000$0.00135$0.00079
Codebase & Context Analysis100,00020,000$0.0135$0.00788
Batch Corpus Processing1,000,000100,000$0.1050$0.0488
Technical Architecture & Pricing VerificationVerified: 2026-09-15 15:00 UTC
Model ArchitectureGemini 2.5 Flash
Provider OrganizationGoogle
Tokenizer EncodingGoogle Gemma SentencePiece (~256k vocabulary)
API ConnectivityGoogle Gemini API with multi-turn chat and long-context video audio ingestion.
Batch API 50% DiscountSupported (50% off input & output)
Tier 1 Rate Quota1,000 RPM · 4M TPM
Blended 3:1 Cost / 1M Tokens$0.13
Ultra-low cost high-volume model ($0.075/1M in, $0.30/1M out). 75% cache discount.Google Cloud Vertex AI Pricing

Verified Pricing History

September 2026: $0.075/M input · $0.3/M output ($0.01875/M cached)
Verified Gemini 2.5 Flash rates.

When to Choose Gemini 2.5 Flash

Ideal for production workloads demanding budget capabilities, deep context depth (1.05M tokens), and reliability from Google. Excellent when predictable tokenomics and prompt caching support are paramount.

When Another Model May Be Better

If your use-case requires sub-second streaming latency or ultra-high frequency classification at micro-cent pricing, consider lighter budget options such as Gemini Flash-Lite or Claude Haiku. For deep formal logic, consider dedicated reasoning models like o3.

Frequently Asked Questions About Gemini 2.5 Flash

How much does 1 million tokens cost with Gemini 2.5 Flash?

For Gemini 2.5 Flash, 1 million input tokens costs $0.075, while 1 million output tokens costs $0.30. If using prompt caching, repetitive input prefixes are discounted to $0.019 per million.

What is the context window for Gemini 2.5 Flash?

Gemini 2.5 Flash features a maximum context window of 1,048,576 tokens (~786,432 words), with a maximum output limit of 8,192 tokens per completion.

Which tokenizer does Gemini 2.5 Flash use?

Gemini 2.5 Flash utilizes the Google Gemma SentencePiece (~256k vocabulary). Token counting on TokenMath runs client-side to ensure maximum privacy.

Does Gemini 2.5 Flash support prompt caching discounts?

Yes. Gemini 2.5 Flash supports prompt caching with a cached input rate of $0.019/1M (saving up to 75% on repeated input context).