Sprachmodelle
15 Modelle · Arena-Score · Stand 2026-09-01Die größte und am härtesten umkämpfte Arena: allgemeine Sprachmodelle für Chat, Reasoning und Schreiben.
| # | Modell | Arena-Score | Stimmen | Lizenz |
|---|---|---|---|---|
| 1 | claude-opus-5-maxAnthropic | 1505±6 | 17 Tsd. | proprietär |
| 2 | claude-opus-5-highAnthropic | 1504±5 | 35 Tsd. | proprietär |
| 3 | claude-opus-4-6-highAnthropic | 1503±4 | 72 Tsd. | proprietär |
| 4 | claude-opus-4-6Anthropic | 1498±4 | 76 Tsd. | proprietär |
| 5 | claude-fable-5Anthropic | 1494±5 | 27 Tsd. | proprietär |
| 6 | gemini-3.7-flash-highGoogle | 1491±8 | 6 Tsd. | proprietär |
| 7 | claude-opus-4-7-highAnthropic | 1490±4 | 60 Tsd. | proprietär |
| 8 | muse-spark-1.2 (xHigh)Meta | 1488±11 | 3 Tsd. | proprietär |
| 9 | gemini-3.5-flash-highGoogle | 1484±5 | 34 Tsd. | proprietär |
| 10 | claude-opus-4-7Anthropic | 1483±4 | 61 Tsd. | proprietär |
| 11 | gemini-3.1-pro-previewGoogle | 1480±3 | 103 Tsd. | proprietär |
| 12 | qwen3.8-maxAlibaba | 1480±7 | 13 Tsd. | proprietär |
| 13 | gemini-3-proGoogle | 1480±4 | 41 Tsd. | proprietär |
| 14 | muse-spark-1.1Meta | 1479±5 | 24 Tsd. | proprietär |
| 15 | gemini-3.6-flash-highGoogle | 1476±6 | 22 Tsd. | proprietär |
Quelle: © LMArena (lmarena-ai), lizenziert CC-BY-4.0 · 1:1 wiedergegeben (Modell, Anbieter, Arena-Score, Stimmen, Lizenz), deutsch beschriftet + von uns analysiert. Arena-Score = Bradley-Terry-Wert aus blinden Mensch-Votes. Logos aus eigener Logo-DB.
Was diese Rangliste nicht misst.
Der Arena-Score misst bevorzugte Antworten, nicht nachhaltiges Können über lange, autonome Aufgaben. Genau diese Lücke schließt Global Rank mit einer eigenen Capability-Achse aus der Aufnahmeprüfung — die einzige, die nicht zukaufbar ist.