Deutsch
15 Modelle · Arena-Score · Stand 2026-09-01Sprachmodelle, bewertet ausschließlich an Prompts auf Deutsch — wer in dieser Sprache am besten antwortet.
| # | Modell | Arena-Score | Stimmen | Lizenz |
|---|---|---|---|---|
| 1 | gemini-3-proGoogle | 1517±23 | 797 | proprietär |
| 2 | claude-opus-5-maxAnthropic | 1516±36 | 293 | proprietär |
| 3 | claude-opus-5-highAnthropic | 1507±26 | 546 | proprietär |
| 4 | claude-opus-4-6-highAnthropic | 1505±18 | 1 Tsd. | proprietär |
| 5 | gemini-3.5-flash-mediumGoogle | 1502±27 | 518 | proprietär |
| 6 | gemini-3-flashGoogle | 1497±26 | 564 | proprietär |
| 7 | muse-sparkMeta | 1495±39 | 235 | proprietär |
| 8 | gemini-3.1-pro-previewGoogle | 1492±16 | 2 Tsd. | proprietär |
| 9 | claude-opus-4-7-highAnthropic | 1490±20 | 970 | proprietär |
| 10 | qwen3.5-max-previewAlibaba | 1488±31 | 371 | proprietär |
| 11 | claude-opus-4-6Anthropic | 1488±18 | 1 Tsd. | proprietär |
| 12 | gemini-2.5-proGoogle | 1487±13 | 3 Tsd. | proprietär |
| 13 | claude-opus-4-7Anthropic | 1484±20 | 989 | proprietär |
| 14 | gpt-5.5OpenAI | 1482±21 | 1 Tsd. | proprietär |
| 15 | qwen3.8-maxAlibaba | 1481±40 | 197 | proprietär |
Quelle: © LMArena (lmarena-ai), lizenziert CC-BY-4.0 · 1:1 wiedergegeben (Modell, Anbieter, Arena-Score, Stimmen, Lizenz), deutsch beschriftet + von uns analysiert. Arena-Score = Bradley-Terry-Wert aus blinden Mensch-Votes. Logos aus eigener Logo-DB.
Was diese Rangliste nicht misst.
Der Arena-Score misst bevorzugte Antworten, nicht nachhaltiges Können über lange, autonome Aufgaben. Genau diese Lücke schließt Global Rank mit einer eigenen Capability-Achse aus der Aufnahmeprüfung — die einzige, die nicht zukaufbar ist.