Meta · Muse
Meta's 30B dense open-weights (Apache-2.0) multimodal reasoning model, small enough for a single high-end consumer GPU.
Leader: Claude Opus 5.5 at 58
Leader: Claude Mythos 5.1 at 60.9%
Leader: Claude Fable 5.1 at 91.4%
Leader: Claude Opus 5.5 at 66.9%
Leader: Claude Opus 5.5 at 89.9%
Leader: Claude Sonnet 5 at 85.2%
Leader: Claude Opus 5.5 at 1846
Leader: Kimi K3 at 84.2%
Leader: Kimi K3 at 84.8%
Leader: Claude Opus 5.5 at 61.4%
Leader: GPT-6 Astra at 96.1%
Leader: GPT-5.6 Sol at 32.3%
Leader: ERNIE 5.1 at 99.6%
Leader: Kimi K3 at 88.7%
Leader: Claude Opus 5.5 at 87.7%
Leader: Claude Fable 5 at 1506
Leader: Claude Opus 5.5 at 1818
| Result | Score | Reported by | Source |
|---|---|---|---|
| AA-Omniscience Index · high | -32.9 index (-100 to 100) | independent | Artificial Analysis: Muse Glimmer (high) ↗ |
| AutomationBench-AA (partial score) · high | 6.8% | independent | Artificial Analysis: Muse Glimmer (high) ↗ |
| DeepSearch QA · High reasoning | 74.6% | vendor | Hugging Face: Muse-Glimmer-30B model card ↗ |
| CharXiv Reasoning · High reasoning | 78.8% | vendor | Hugging Face: Muse-Glimmer-30B model card ↗ |
| ScreenSpot Pro · High reasoning | 75.4% | vendor | Hugging Face: Muse-Glimmer-30B model card ↗ |
| IFBench · High reasoning | 77% | vendor | Hugging Face: Muse-Glimmer-30B model card ↗ |
| Local speed (RTX 5090, DFlash speculative decoding) · vendor measurement | 233.4 tokens/s | vendor | Hugging Face: Muse-Glimmer-30B model card ↗ |