Skip to content

Compare model prices

Input, output, cached and batch prices, every route and a month of tokens, side by side.

Gemma 3 4BGemini 3.8 Flash

A month of tokens

  • Gemma 3 4B$7.00
  • Gemini 3.8 Flash$150.00

100M input and 20M output tokens, list price. Use your own numbers.

Side by side

Gemma 3 4BGemini 3.8 Flash
Input per 1M$0.05$0.75
Output per 1M$0.1$3.75
Cached inputn/a$0.075
Batch in / outn/a$0.375 / $1.88
Blended (3:1)$0.063$1.5
Context131K1M
Routes16
ReleasedMar 13, 2025Sep 2, 2026
Leadersboard scoren/a15 (#13)

On the price map

$0.03$0.1$0.3$1$3$10$30$100$0.03$0.1$0.3$1$3$10$30$100$300Input $ per 1M tokensOutput $ per 1M tokensxxZZDMOOOOOOOOOOOOOOOOZDGMMDMGDQMGGMMZGGDDGGGGGGGGMOOOZQAQQAQQQAAAQAQxQQAQQAQAAAAQQQQxxxOOOOOOOOOOOOOOOOOAAOMMQQQMGGMQQQQQQQMMMMQQQQQQQMQQQQxMMCZZZZZZZAAAOAOOOOOOOACDDDDDMDDMGGZMOQQQMOOZZQMMQQQQQGGGMMMMMMOOOMQCAOCCOOOOOOMQGGGZMDMMGMMQQQ
Size: context window, 8K to 2MEqual blended cost (3:1) 243 models, lower left is cheaper

Every route

Gemma 3 4B

Way to buyIn / out per 1M
DeepInfra
bf16
$0.05 / $0.1Same as list

Gemini 3.8 Flash

Way to buyIn / out per 1M
Google Vertex AI
global-flex, cheapest · cached $0.037
$0.375 / $1.88-50% vs list
Google Gemini API
flex · cached $0.037
$0.375 / $1.88-50% vs list
Google Gemini API API
The lab's own API · cached $0.075
$0.75 / $3.75List price
Google Vertex AI
global · cached $0.075
$0.75 / $3.75Same as list
Google Vertex AI
global-priority · cached $0.135
$1.35 / $6.75+80% vs list
Google Gemini API
priority · cached $0.135
$1.35 / $6.75+80% vs list

List prices from providers' pages on the date shown; your contract may differ. Logos via logo.dev; trademarks belong to their owners.

Weekly: LLM API list prices that changed, Thursday mornings.