DeepSeek R1 0528 has a larger context window than GPT-2 (164K tokens vs 1K tokens).
| Spec | DeepSeek R1 0528 | GPT-2 |
|---|---|---|
| Input price | Free | — |
| Output price | Free | — |
| Context window | 164K tokens | 1K tokens |
| Parameters | 671B (37B active) | 1.5B |
| Weights | Open | Open |
| Free API (OpenRouter) | No | — |
| Released | May 2025 | Nov 2019 |
Not enough votes to call it. On the specs, DeepSeek R1 0528 has the edge: bigger model tier, newer, bigger context window.
No hosts listed on OpenRouter.
Per million tokens. Prices and uptime via OpenRouter, checked 9 Sep 2026.
DeepSeek R1 0528 uses 46.8x more hedging