Unterhaltung, Sport & Medien
15 Modelle · Arena-Score · Stand 2026-09-01Wie schlagen sich Sprachmodelle bei Aufgaben aus dem Bereich „Unterhaltung, Sport & Medien"? Diese Rangliste filtert auf berufsfeld-typische Prompts.
| # | Modell | Arena-Score | Stimmen | Lizenz |
|---|---|---|---|---|
| 144 | gpt-5.3-chat-latestOpenAI | 1355±8 | 6 Tsd. | proprietär |
| 145 | TEhunyuan-t1-20250711Tencent | 1354±19 | 851 | proprietär |
| 146 | gemini-2.5-flash-lite-preview-06-17-thinkingGoogle | 1354±8 | 6 Tsd. | proprietär |
| 147 | muse-glimmerMeta | 1352±20 | 926 | offen |
| 148 | THInkling SmallThinky | 1350±10 | 4 Tsd. | offen |
| 149 | qwen3-next-80b-a3b-instructAlibaba | 1349±10 | 4 Tsd. | offen |
| 150 | claude-opus-4-20250514Anthropic | 1349±8 | 7 Tsd. | proprietär |
| 151 | qwen3-235b-a22b-no-thinkingAlibaba | 1349±8 | 7 Tsd. | offen |
| 152 | AMamazon-nova-experimental-chat-26-01-10Amazon | 1348±24 | 600 | proprietär |
| 153 | qwen3.5-35b-a3bAlibaba | 1348±9 | 6 Tsd. | offen |
| 154 | qwen3.5-flashAlibaba | 1347±7 | 12 Tsd. | proprietär |
| 155 | DEdeepseek-r1Deepseek | 1347±10 | 4 Tsd. | offen |
| 156 | AMamazon-nova-experimental-chat-12-10Amazon | 1346±21 | 724 | proprietär |
| 157 | Z.glm-4.6vZ.ai | 1346±26 | 504 | offen |
| 158 | gemini-2.5-flash-lite-preview-09-2025-no-thinkingGoogle | 1345±7 | 8 Tsd. | proprietär |
Quelle: © LMArena (lmarena-ai), lizenziert CC-BY-4.0 · 1:1 wiedergegeben (Modell, Anbieter, Arena-Score, Stimmen, Lizenz), deutsch beschriftet + von uns analysiert. Arena-Score = Bradley-Terry-Wert aus blinden Mensch-Votes. Logos aus eigener Logo-DB.
Was diese Rangliste nicht misst.
Der Arena-Score misst bevorzugte Antworten, nicht nachhaltiges Können über lange, autonome Aufgaben. Genau diese Lücke schließt Global Rank mit einer eigenen Capability-Achse aus der Aufnahmeprüfung — die einzige, die nicht zukaufbar ist.