Qwen: Qwen3.8 Max Prime
QWEN Developer Architecture Profile
Intelligence (ELO)1492Chatbot Arena Verified
Max Context Limit1,000,000Max Out: 131,072 tokens
Prompt Caching88% OFF$0.50 / 1M cached
Standard API / 1M$16.00Blended Standard Rate
Model Capabilities & Contract SLAs
- Agentic
- Coding & Logic
- Fictional
- 🛠️ Native Tool Calling
Qwen3.8 Max Prime is a higher-throughput variant of Qwen3.8 Max from Alibaba's Qwen team, served as a separate SKU at a higher price point. It accepts text, image, and video...
Granular Pricing Matrix
Input Tokens (Standard Prompt)$4.00 / 1M
⚡ Cached Input (Prompt Cache Read)88% OFF$0.50 / 1M
Output Tokens (Completion)$12.00 / 1M
Pricing data via OpenRouter. Sync: 10/2/2026
Evaluate Competitors
VS Engine MatchupQwen: Qwen3.8 Max Prime vs OpenAI: GPT-4.1 Mini (batch)VS Engine MatchupQwen: Qwen3.8 Max Prime vs OpenAI: GPT-5.6 Sol (batch)VS Engine MatchupQwen: Qwen3.8 Max Prime vs Google: Gemini 3.5 FlashVS Engine MatchupQwen: Qwen3.8 Max Prime vs Google: Gemini 3.5 Flash (batch)VS Engine MatchupQwen: Qwen3.8 Max Prime vs Google: Gemini 3.1 Flash LiteVS Engine MatchupQwen: Qwen3.8 Max Prime vs OpenAI: GPT-5.4 Nano (batch)