Skip to content

Compare model prices

Input, output, cached and batch prices, every route and a month of tokens, side by side.

Gemma 4 31BGemini 3.8 Flash

A month of tokens

  • Gemma 4 31B$15.80
  • Gemini 3.8 Flash$150.00

100M input and 20M output tokens, list price. Use your own numbers.

Side by side

Gemma 4 31BGemini 3.8 Flash
Input per 1M$0.09$0.75
Output per 1M$0.34$3.75
Cached input$0.05$0.075
Batch in / outn/a$0.375 / $1.88
Blended (3:1)$0.153$1.5
Context262K1M
Routes136
ReleasedApr 2, 2026Sep 2, 2026
Leadersboard scoren/a15 (#13)

On the price map

$0.03$0.1$0.3$1$3$10$30$100$0.03$0.1$0.3$1$3$10$30$100$300Input $ per 1M tokensOutput $ per 1M tokensxxZZDMOOOOOOOOOOOOOOOOZDGMMDMGDQMGGMMZGGDDGGGGGGGGMOOOZQAQQAQQQAAAQAQxQQAQQAQAAAAQQQQxxxOOOOOOOOOOOOOOOOOAAOMMQQQMGGMQQQQQQQMMMMQQQQQQQMQQQQxMMCZZZZZZZAAAOAOOOOOOOACDDDDDMDDMGGZMOQQQMOOZZQMMQQQQQGGGMMMMMMOOOMQCAOCCOOOOOOMQGGGZMDMMGMMQQQ
Size: context window, 8K to 2MEqual blended cost (3:1) 243 models, lower left is cheaper

Every route

Gemma 4 31B

Way to buyIn / out per 1M
DeepInfra
turbo, fp4 · cached $0.05
$0.09 / $0.34Same as list
CoreWeave
fp4 · cached $0.1
$0.1 / $0.34+5% vs list
Venice
fp4 · cached $0.09
$0.12 / $0.36+18% vs list
Chutes
fp4 · cached $0.012
$0.12 / $0.37+20% vs list
DeepInfra
fp8
$0.13 / $0.38+26% vs list
Crusoe
bf16 · cached $0.14
$0.14 / $0.4+34% vs list
Friendli
Default region
$0.14 / $0.4+34% vs list
Novita AI
bf16
$0.14 / $0.4+34% vs list
Parasail
fp8 · cached $0.06
$0.15 / $0.4+39% vs list
DeepInfra
ultra, fp8
$0.27 / $0.76+157% vs list
SambaNova
Default region
$0.38 / $1.15+275% vs list
ModelRun
fp4 · cached $0.75
$0.75 / $1+433% vs list
SiliconFlow
fp8 · cached $0.25
$0.75 / $1+433% vs list

Gemini 3.8 Flash

Way to buyIn / out per 1M
Google Vertex AI
global-flex, cheapest · cached $0.037
$0.375 / $1.88-50% vs list
Google Gemini API
flex · cached $0.037
$0.375 / $1.88-50% vs list
Google Gemini API API
The lab's own API · cached $0.075
$0.75 / $3.75List price
Google Vertex AI
global · cached $0.075
$0.75 / $3.75Same as list
Google Vertex AI
global-priority · cached $0.135
$1.35 / $6.75+80% vs list
Google Gemini API
priority · cached $0.135
$1.35 / $6.75+80% vs list

List prices from providers' pages on the date shown; your contract may differ. Logos via logo.dev; trademarks belong to their owners.

Weekly: LLM API list prices that changed, Thursday mornings.