Moonshot AI · Kimi K2
Coding-tuned open 1T/32B MoE and Moonshot's low-cost coding API. It sits below K3 and has been partly displaced in Kimi Code by the K2.8 Preview.
Leader: Claude Opus 5.5 at 58
Leader: Claude Mythos 5.1 at 60.9%
Leader: Claude Fable 5.1 at 91.4%
Leader: Claude Opus 5.5 at 66.9%
Leader: GPT-6 Astra at 96.1%
Leader: Claude Opus 5.5 at 61.4%
Leader: GPT-5.6 Sol at 32.3%
Leader: Kimi K3 at 88.7%
Leader: Claude Opus 5.5 at 1818
| Result | Score | Reported by | Source |
|---|---|---|---|
| IFBench (AA) · reasoning | 63.1% | independent | Artificial Analysis: Kimi K2.7 Code ↗ |
| Terminal-Bench Hard (AA) · reasoning | 44.7% | independent | Artificial Analysis: Kimi K2.7 Code ↗ |
| Kimi Code Bench v2 | 62% | vendor | Kimi K2.7 Code model card (Hugging Face) ↗ |
| MCP Mark Verified | 81.1% | vendor | Kimi K2.7 Code model card (Hugging Face) ↗ |
| Program Bench | 53.6% | vendor | Kimi K2.7 Code model card (Hugging Face) ↗ |