Llama 3.2 3B Instruct
META-LLAMA Developer Architecture Profile
Intelligence (ELO)1424Chatbot Arena Verified
Max Context Limit131,072Max Out: 117,964 tokens
Prompt CachingStandardNo Cache Discount
Standard API / 1M$0.38🧠 Deep Reasoner
Model Capabilities & Contract SLAs
- Classification
- Conversational
- Reasoning
- Agentic
- Coding & Logic
- Fictional
- 🛠️ Native Tool Calling
- 🧠 Extended Test-Time Reasoning
Llama 3.2 3B is a 3-billion-parameter multilingual large language model, optimized for advanced natural language processing tasks like dialogue generation, reasoning, and summarization. Designed with the latest transformer architecture, it...
Granular Pricing Matrix
Input Tokens (Standard Prompt)$0.05 / 1M
Output Tokens (Completion)$0.33 / 1M
Pricing data via OpenRouter. Sync: 10/2/2026
Evaluate Competitors
VS Engine MatchupLlama 3.2 3B Instruct vs Qwen: Qwen3.8 Omni FlashVS Engine MatchupLlama 3.2 3B Instruct vs Qwen: Qwen3.6 35B A3BVS Engine MatchupLlama 3.2 3B Instruct vs Qwen: Qwen3 MaxVS Engine MatchupLlama 3.2 3B Instruct vs Qwen: Qwen3 Coder FlashVS Engine MatchupLlama 3.2 3B Instruct vs Z.ai: GLM 4.5VS Engine MatchupLlama 3.2 3B Instruct vs Z.ai: GLM Flash Latest