OpenAI · gpt-oss
OpenAI's small open-weights MoE reasoning model (Apache-2.0) for local and edge use.
Leader: Claude Opus 5.5 at 58
Leader: Claude Mythos 5.1 at 60.9%
Leader: Claude Fable 5.1 at 91.4%
Leader: Claude Opus 5.5 at 66.9%
Leader: Fugu at 92.9%
Leader: Claude Opus 5.5 at 61.4%
Leader: GPT-6 Astra at 96.1%
Leader: GPT-5.6 Sol at 32.3%
Leader: Kimi K3 at 88.7%
Leader: Claude Fable 5 at 1506
| Result | Score | Reported by | Source |
|---|---|---|---|
| aime-2025 · AA, high | 89.3% | independent | Artificial Analysis: gpt-oss-20b (high) ↗ |
| AA-Omniscience Index · high | -63 index (-100 to 100) | independent | Artificial Analysis: gpt-oss-20b (high) ↗ |
| AutomationBench-AA (partial score) · high | 0.2% | independent | Artificial Analysis: gpt-oss-20b (high) ↗ |