Skip to content

Compare model prices

Input, output, cached and batch prices, every route and a month of tokens, side by side.

Qwen3.5 397B A17BQwen3.8 Max Prime

A month of tokens

  • Qwen3.5 397B A17B$85.80
  • Qwen3.8 Max Prime$640.00

100M input and 20M output tokens, list price. Use your own numbers.

Side by side

Qwen3.5 397B A17BQwen3.8 Max Prime
Input per 1M$0.39$4
Output per 1M$2.34$12
Cached inputn/a$0.5
Batch in / outn/an/a
Blended (3:1)$0.878$6
Context262K1M
Routes101
ReleasedFeb 16, 2026Sep 23, 2026
Leadersboard scoren/an/a

On the price map

$0.03$0.1$0.3$1$3$10$30$100$0.03$0.1$0.3$1$3$10$30$100$300Input $ per 1M tokensOutput $ per 1M tokensxxZZDMOOOOOOOOOOOOOOOOZDGMMDMGDQMGGMMZGGDDGGGGGGGGMOOOZQAQQAQQQAAAQAQxQQAQQAQAAAAQQQQxxxOOOOOOOOOOOOOOOOOAAOMMQQQMGGMQQQQQQQMMMMQQQQQQQMQQQQxMMCZZZZZZZAAAOAOOOOOOOACDDDDDMDDMGGZMOQQQMOOZZQMMQQQQQGGGMMMMMMOOOMQCAOCCOOOOOOMQGGGZMDMMGMMQQQ
Size: context window, 8K to 2MEqual blended cost (3:1) 243 models, lower left is cheaper

Every route

Qwen3.5 397B A17B

  • Qwen (Alibaba) (list)the lab's own API$0.39 / $2.34$0.878 blended
  • DeepInfrafp8, fp8+24%$0.45 / $3cached $0.22
  • Parasailfp8, fp8+45%$0.5 / $3.6cached $0.3
  • AtlasCloudfp8, fp8+47%$0.55 / $3.5cached $0.55
  • DigitalOceandefault region+47%$0.55 / $3.5cached $0.11
  • Phaladefault region+47%$0.55 / $3.5cached $0.225
  • GMICloudfp8, fp8+54%$0.6 / $3.6$1.35 blended
  • Novita AIdefault region+54%$0.6 / $3.6$1.35 blended
  • StreamLakedefault region+54%$0.6 / $3.6cached $0.12
  • Venicedefault region+92%$0.75 / $4.5$1.69 blended

Qwen3.8 Max Prime

  • Qwen (Alibaba) (list)the lab's own API$4 / $12cached $0.5

List prices from providers' pages on the date shown; your contract may differ. Logos via logo.dev; trademarks belong to their owners.

Weekly: LLM API list prices that changed, Thursday mornings.