Compare model prices
Input, output, cached and batch prices, every route and a month of tokens, side by side.
A month of tokens
Qwen3.8 2.4T A95B$320.00
Qwen3.8 Max Prime$640.00
100M input and 20M output tokens, list price. Use your own numbers.
Side by side
| Qwen3.8 2.4T A95B | Qwen3.8 Max Prime | |
|---|---|---|
| Input per 1M | $2 | $4 |
| Output per 1M | $6 | $12 |
| Cached input | $0.25 | $0.5 |
| Batch in / out | n/a | n/a |
| Blended (3:1) | $3 | $6 |
| Context | 1M | 1M |
| Routes | 7 | 1 |
| Released | Aug 12, 2026 | Sep 23, 2026 |
| Leadersboard score | 5 (#27) | n/a |
On the price map
Size: context window, 8K to 2MEqual blended cost (3:1) 243 models, lower left is cheaper
Every route
Qwen3.8 2.4T A95B
DeepInfrafp4, fp4$2 / $6cached $0.2
Qwen (Alibaba) (list)the lab's own API$2 / $6cached $0.25
Modaldefault region$2 / $6cached $0.25
Novita AIdefault region$2 / $6cached $0.25
SiliconFlowfp8, fp8$2 / $6cached $0.25
Together AIdefault region$2 / $6cached $0.25
Venicedefault region$2 / $6cached $0.25
Qwen3.8 Max Prime
Qwen (Alibaba) (list)the lab's own API$4 / $12cached $0.5
List prices from providers' pages on the date shown; your contract may differ. Logos via logo.dev; trademarks belong to their owners.