StepFun · Step 3
Small open-weight StepFun vision-language reasoning model for local/edge multimodal use.
Leader: Claude Opus 5.5 at 58
Leader: GLM-5.2 at 99.1%
Leader: Claude Opus 5.5 at 61.4%
Leader: GPT-6 Astra at 96.1%
Leader: GPT-5.6 Sol at 32.3%
Leader: Kimi K3 at 88.7%
Leader: Claude Opus 5.5 at 87.7%
| Result | Score | Reported by | Source |
|---|---|---|---|
| Terminal-Bench Hard (AA) · AA | 5.3% | independent | Artificial Analysis: Step3 VL 10B ↗ |
| IFBench (AA) · AA | 50.2% | independent | Artificial Analysis: Step3 VL 10B ↗ |
| AA-Omniscience Index · AA | -59 index (-100..100) | independent | Artificial Analysis: Step3 VL 10B ↗ |