Qwen: Qwen3 8B
QWEN Developer Architecture Profile
Intelligence (ELO)1432Chatbot Arena Verified
Max Context Limit131,072Max Out: 8,192 tokens
Prompt CachingStandardNo Cache Discount
Standard API / 1M$0.57🧠 Deep Reasoner
Model Capabilities & Contract SLAs
- Drafting
- Classification
- Reasoning
- Agentic
- Coding & Logic
- Fictional
- 🛠️ Native Tool Calling
- 🧠 Extended Test-Time Reasoning
Qwen3-8B is a dense 8.2B parameter causal language model from the Qwen3 series, designed for both reasoning-heavy tasks and efficient dialogue. It supports seamless switching between "thinking" mode for math,...
Granular Pricing Matrix
Input Tokens (Standard Prompt)$0.12 / 1M
Output Tokens (Completion)$0.45 / 1M
Pricing data via OpenRouter. Sync: 10/2/2026
Evaluate Competitors
VS Engine MatchupQwen: Qwen3 8B vs Tencent: Hy3 previewVS Engine MatchupQwen: Qwen3 8B vs NVIDIA: Nemotron 3 SuperVS Engine MatchupQwen: Qwen3 8B vs TheDrummer: Cydonia 24B V4.1VS Engine MatchupQwen: Qwen3 8B vs Tencent: Hunyuan A13B InstructVS Engine MatchupQwen: Qwen3 8B vs Reka Flash 3VS Engine MatchupQwen: Qwen3 8B vs OpenAI: GPT-6 Luna