Gemini 3.5 Flash
GOOGLE Developer Architecture Profile
Intelligence (ELO)1493Chatbot Arena Verified
Max Context Limit1,048,576Max Out: 65,536 tokens
Prompt Caching90% OFF$0.15 / 1M cached
Standard API / 1M$10.50🧠 Deep Reasoner
Model Capabilities & Contract SLAs
- Fictional
- Drafting
- Classification
- Conversational
- Reasoning
- Agentic
- Coding & Logic
- 📋 Strict JSON Schema
- 🛠️ Native Tool Calling
- 🧠 Extended Test-Time Reasoning
Gemini 3.5 Flash is Google's high-efficiency multimodal model, bringing near-Pro level coding and reasoning at Flash-tier cost and speed. It is highly optimized for coding proficiency and parallel agentic execution...
Granular Pricing Matrix
Input Tokens (Standard Prompt)$1.50 / 1M
⚡ Cached Input (Prompt Cache Read)90% OFF$0.15 / 1M
Output Tokens (Completion)$9.00 / 1M
Internal Reasoning Tokens$9.00 / 1M
Pricing data via OpenRouter. Sync: 10/2/2026
Evaluate Competitors
VS Engine MatchupGemini 3.5 Flash vs Google: Gemini 3.5 Flash (batch)VS Engine MatchupGemini 3.5 Flash vs Google: Gemini 3.1 Flash LiteVS Engine MatchupGemini 3.5 Flash vs Google: Nano Banana 2 (Gemini 3.1 Flash Image Preview)VS Engine MatchupGemini 3.5 Flash vs Google: Gemini 3.1 Pro Preview Custom ToolsVS Engine MatchupGemini 3.5 Flash vs OpenAI: GPT-4.1 MiniVS Engine MatchupGemini 3.5 Flash vs Qwen: Qwen3.8 Max Prime