Comparison

Gemini 3.5 Flash vs GPT-5.4 mini

GPT-5.4 mini costs 50% less per input token than Gemini 3.5 Flash. GPT-5.4 mini is 50% cheaper on output tokens. Gemini 3.5 Flash accepts more context per request than GPT-5.4 mini.

FieldGemini 3.5 Flash
GPT-5.4 mini
ProviderGoogleOpenAI
Context window1M400K
Max output65.5K128K
Input / 1M$1.50$0.7550% cheaper
Output / 1M$9.00$4.5050% cheaper
Cached input / 1M$0.15$0.07550% cheaper
Batch discount50%50%
Release date2026-03-17

Worked cost examples

Estimated monthly cost on three common usage shapes

WorkloadGemini 3.5 FlashGPT-5.4 mini

Chatbot

800 input / 200 output tokens per request, 100,000 requests/month

$300.00$150.00cheaper

RAG pipeline

6,000 input / 700 output tokens per request, 30,000 requests/month

$459.00$229.50cheaper

Batch summarization

20,000 input / 1,500 output tokens per request, 5,000 requests/month

$217.50$108.75cheaper

Gemini 3.5 Flash vs GPT-5.4 mini FAQ

Is Gemini 3.5 Flash cheaper than GPT-5.4 mini?
Gemini 3.5 Flash costs $1.50 per 1M input tokens versus $0.75 for GPT-5.4 mini — GPT-5.4 mini is 100% cheaper per input token.
Which is cheaper for output tokens, Gemini 3.5 Flash or GPT-5.4 mini?
Gemini 3.5 Flash charges $9.00 per 1M output tokens; GPT-5.4 mini charges $4.50 per 1M output tokens.
Which has the larger context window, Gemini 3.5 Flash or GPT-5.4 mini?
Gemini 3.5 Flash does, with a 1,048,576-token context window.
Do Gemini 3.5 Flash and GPT-5.4 mini offer cache pricing?
Gemini 3.5 Flash discounts cached input to $0.15 per 1M tokens. GPT-5.4 mini discounts cached input to $0.075 per 1M tokens.

Looking for another matchup? See all comparisons.