Gemini 2.5 Flash
GOOGLE Developer Architecture Profile
Intelligence (ELO)1484Chatbot Arena Verified
Max Context Limit1,048,576Max Out: 65,535 tokens
Prompt Caching90% OFF$0.03 / 1M cached
Standard API / 1M$2.80🧠 Deep Reasoner
Model Capabilities & Contract SLAs
- Drafting
- Classification
- Conversational
- Reasoning
- Agentic
- Coding & Logic
- Fictional
- 📋 Strict JSON Schema
- 🛠️ Native Tool Calling
- 🧠 Extended Test-Time Reasoning
Gemini 2.5 Flash is Google's state-of-the-art workhorse model, specifically designed for advanced reasoning, coding, mathematics, and scientific tasks. It includes built-in "thinking" capabilities, enabling it to provide responses with greater...
Granular Pricing Matrix
Input Tokens (Standard Prompt)$0.30 / 1M
⚡ Cached Input (Prompt Cache Read)90% OFF$0.03 / 1M
Output Tokens (Completion)$2.50 / 1M
Internal Reasoning Tokens$2.50 / 1M
Pricing data via OpenRouter. Sync: 10/2/2026
Evaluate Competitors
VS Engine MatchupGemini 2.5 Flash vs OpenAI: GPT-5 Nano (batch)VS Engine MatchupGemini 2.5 Flash vs Google: Gemini 2.5 Flash Lite (batch)VS Engine MatchupGemini 2.5 Flash vs Anthropic: Claude Opus 5.5VS Engine MatchupGemini 2.5 Flash vs OpenAI: GPT-5.6 Terra (batch)VS Engine MatchupGemini 2.5 Flash vs Anthropic: Claude Opus 4.7VS Engine MatchupGemini 2.5 Flash vs OpenAI: GPT-5.4 Nano