Gemini 2.0 Flash Thinking is cheaper than o3 Mini at $0.25/M vs $1.1/M input tokens.
| Spec | Gemini 2.0 Flash Thinking | o3 Mini |
|---|---|---|
| Input price | $0.25/M tokens | $1.1/M tokens |
| Output price | $0.5/M tokens | $4.4/M tokens |
| Context window | 500K tokens | 64K tokens |
| Released | Dec 2024 | Dec 2024 |
| MMLU | 82.3% | 85.9% |
Not enough votes to call it. On the specs, Gemini 2.0 Flash Thinking has the edge: bigger model tier, bigger context window.
Gemini 2.0 Flash Thinking costs 8.8x less per token.
Gemini 2.0 Flash Thinking is cheaper on both — 4.4× input, 8.8× output
o3 Mini uses 14.0x more headings
Gemini 2.0 Flash Thinking is cheaper than o3 Mini at $0.25/M vs $1.1/M input tokens.
| Spec | Gemini 2.0 Flash Thinking | o3 Mini |
|---|---|---|
| Input price | $0.25/M tokens | $1.1/M tokens |
| Output price | $0.5/M tokens | $4.4/M tokens |
| Context window | 500K tokens | 64K tokens |
| Released | Dec 2024 | Dec 2024 |
| MMLU | 82.3% | 85.9% |
Not enough votes to call it. On the specs, Gemini 2.0 Flash Thinking has the edge: bigger model tier, bigger context window.
Gemini 2.0 Flash Thinking costs 8.8x less per token.
Gemini 2.0 Flash Thinking is cheaper on both — 4.4× input, 8.8× output
o3 Mini uses 14.0x more headings