KI-Weltrangliste · Disziplin · Reichweite belegt · Fähigkeit geprüft

Coding / Vibe-Coding

Sprachmodelle, bewertet speziell auf „Coding / Vibe-Coding". Wer hier führt, ist nicht automatisch Gesamt-Erster. Jede Zahl mit Quelle und Lizenz — plus eigene Analyse, die kein anderer Anbieter liefert.

Coding / Vibe-Coding

15 Modelle · Arena-Score · Stand 2026-09-01

Sprachmodelle, bewertet speziell auf „Coding / Vibe-Coding". Wer hier führt, ist nicht automatisch Gesamt-Erster.

#ModellArena-ScoreStimmenLizenz
1 claude-opus-4-6-highAnthropic 1535±6 19 Tsd. proprietär
2 claude-opus-4-6Anthropic 1534±5 21 Tsd. proprietär
3 claude-opus-5-highAnthropic 1531±8 9 Tsd. proprietär
4 claude-opus-5-maxAnthropic 1529±10 4 Tsd. proprietär
5 claude-fable-5Anthropic 1520±8 7 Tsd. proprietär
6 glm-5.3-flashZ.ai 1519±18 1 Tsd. offen
7 claude-opus-4-7-highAnthropic 1519±6 17 Tsd. proprietär
8 claude-opus-4-7Anthropic 1515±6 17 Tsd. proprietär
9 kimi-k3-maxMoonshot 1510±10 5 Tsd. offen
10 gemini-3.7-flash-highGoogle 1504±15 2 Tsd. proprietär
11 claude-sonnet-4-6Anthropic 1504±6 18 Tsd. proprietär
12 claude-opus-4-5-20251101-high-32kAnthropic 1503±8 8 Tsd. proprietär
13 glm-5.3-maxZ.ai 1503±14 2 Tsd. offen
14 mimo-v2.5-proXiaomi 1501±6 16 Tsd. offen
15 claude-opus-4-5-20251101Anthropic 1499±6 17 Tsd. proprietär

Quelle: © LMArena (lmarena-ai), lizenziert CC-BY-4.0 · 1:1 wiedergegeben (Modell, Anbieter, Arena-Score, Stimmen, Lizenz), deutsch beschriftet + von uns analysiert. Arena-Score = Bradley-Terry-Wert aus blinden Mensch-Votes. Logos aus eigener Logo-DB.

Was diese Rangliste nicht misst.

Der Arena-Score misst bevorzugte Antworten, nicht nachhaltiges Können über lange, autonome Aufgaben. Genau diese Lücke schließt Global Rank mit einer eigenen Capability-Achse aus der Aufnahmeprüfung — die einzige, die nicht zukaufbar ist.

Saubere Übersicht →