xAI · Grok 4
Previous Grok flagship (August 2026), same price as Grok 4.7.
Leader: Claude Opus 5.5 at 58
Leader: Claude Mythos 5.1 at 60.9%
Leader: Claude Opus 5.5 at 66.9%
Leader: Claude Opus 5.5 at 1846
Leader: Claude Opus 5.5 at 61.4%
Leader: GPT-6 Astra at 96.1%
Leader: GPT-5.6 Sol at 32.3%
Leader: GPT-6 Astra at 95%
Leader: GPT-6 Astra at 62.7%
Leader: Kimi K3 at 88.7%
Leader: Claude Fable 5 at 1506
Leader: Claude Opus 5.5 at 1818
| Result | Score | Reported by | Source |
|---|---|---|---|
| AA-Omniscience Index · high | 30.5 index (-100 to 100) | independent | Artificial Analysis: Grok 4.6 (high) ↗ |
| AutomationBench-AA (partial score) · high | 66.7% | independent | Artificial Analysis: Grok 4.6 (high) ↗ |
| Terminal-Bench Science (AA) · high | 6.2% | independent | Artificial Analysis: Grok 4.6 (high) ↗ |
| AA Coding Agent Index v1.5 · Grok Build + Grok 4.6 (xhigh); DeepSWE 64.9 / SWE-Atlas-QnA 58.3 / TB4 17.7 | 47 index | independent | Artificial Analysis Coding Agents ↗ |
| CursorBench 4.0 · High | 40.4% | vendor | xAI: Grok 4.7 (comparison table) ↗ |
| DeepSWE v1.1 · High | 65.2% | vendor | xAI: Grok 4.7 (comparison table) ↗ |