KI-Weltrangliste · Sprache · Reichweite belegt · Fähigkeit geprüft

Englisch

Sprachmodelle, bewertet ausschließlich an Prompts auf Englisch — wer in dieser Sprache am besten antwortet. Jede Zahl mit Quelle und Lizenz — plus eigene Analyse, die kein anderer Anbieter liefert.

Englisch

15 Modelle · Arena-Score · Stand 2026-09-01

Sprachmodelle, bewertet ausschließlich an Prompts auf Englisch — wer in dieser Sprache am besten antwortet.

#ModellArena-ScoreStimmenLizenz
1 claude-opus-4-6-highAnthropic 1512±5 32 Tsd. proprietär
2 claude-opus-4-6Anthropic 1506±5 34 Tsd. proprietär
3 claude-opus-5-maxAnthropic 1502±8 7 Tsd. proprietär
4 claude-opus-5-highAnthropic 1500±6 14 Tsd. proprietär
5 claude-fable-5Anthropic 1499±6 12 Tsd. proprietär
6 claude-opus-4-7-highAnthropic 1495±5 28 Tsd. proprietär
7 glm-5.3-maxZ.ai 1494±11 3 Tsd. offen
8 muse-spark-1.2 (xHigh)Meta 1492±16 1 Tsd. proprietär
9 qwen3.8-maxAlibaba 1489±9 5 Tsd. proprietär
10 gemini-3.7-flash-highGoogle 1487±13 2 Tsd. proprietär
11 claude-opus-4-7Anthropic 1486±5 28 Tsd. proprietär
12 kimi-k3-maxMoonshot 1483±8 7 Tsd. offen
13 muse-sparkMeta 1480±8 6 Tsd. proprietär
14 gemini-3.5-flash-highGoogle 1480±6 15 Tsd. proprietär
15 muse-spark-1.1Meta 1479±7 10 Tsd. proprietär

Quelle: © LMArena (lmarena-ai), lizenziert CC-BY-4.0 · 1:1 wiedergegeben (Modell, Anbieter, Arena-Score, Stimmen, Lizenz), deutsch beschriftet + von uns analysiert. Arena-Score = Bradley-Terry-Wert aus blinden Mensch-Votes. Logos aus eigener Logo-DB.

Was diese Rangliste nicht misst.

Der Arena-Score misst bevorzugte Antworten, nicht nachhaltiges Können über lange, autonome Aufgaben. Genau diese Lücke schließt Global Rank mit einer eigenen Capability-Achse aus der Aufnahmeprüfung — die einzige, die nicht zukaufbar ist.

Saubere Übersicht →