GPT OSS 120B has a larger context window than GPT-2 (131K tokens vs 1K tokens).
| Spec | GPT-2 | GPT OSS 120B |
|---|---|---|
| Input price | — | $0.18/M tokens |
| Output price | — | $0.8/M tokens |
| Context window | 1K tokens | 131K tokens |
| Released | Nov 2019 | Aug 2025 |
Not enough votes to call it. On the specs, GPT OSS 120B has the edge: bigger model tier, newer, bigger context window.
GPT OSS 120B uses 27.6x more hedging
GPT OSS 120B has a larger context window than GPT-2 (131K tokens vs 1K tokens).
| Spec | GPT-2 | GPT OSS 120B |
|---|---|---|
| Input price | — | $0.18/M tokens |
| Output price | — | $0.8/M tokens |
| Context window | 1K tokens | 131K tokens |
| Released | Nov 2019 | Aug 2025 |
Not enough votes to call it. On the specs, GPT OSS 120B has the edge: bigger model tier, newer, bigger context window.
GPT OSS 120B uses 27.6x more hedging