KI-Weltrangliste · Agent · Reichweite belegt · Fähigkeit geprüft

Such-Agenten

Systeme, die für die Antwort live im Web recherchieren und ihre Aussagen mit Quellen belegen (Grounding). Jede Zahl mit Quelle und Lizenz — plus eigene Analyse, die kein anderer Anbieter liefert.

Such-Agenten

15 Modelle · Arena-Score · Stand 2026-09-01

Systeme, die für die Antwort live im Web recherchieren und ihre Aussagen mit Quellen belegen (Grounding).

#ModellArena-ScoreStimmenLizenz
1 gpt-5.6-sol-xhighOpenAI 1257±8 30 Tsd. proprietär
2 claude-opus-4-6-searchAnthropic 1253±5 135 Tsd. proprietär
3 gpt-5.5-searchOpenAI 1242±5 90 Tsd. proprietär
4 claude-opus-4-7Anthropic 1233±6 91 Tsd. proprietär
5 claude-fable-5Anthropic 1230±8 42 Tsd. proprietär
6 ernie-5.1Baidu 1227±10 4 Tsd. proprietär
7 claude-sonnet-4-6-searchAnthropic 1221±5 135 Tsd. proprietär
8 grok-4.5xAI 1213±7 32 Tsd. proprietär
9 gemini-3.1-pro-groundingGoogle 1210±6 113 Tsd. proprietär
10 gemini-3-pro-groundingGoogle 1207±6 37 Tsd. proprietär
11 gpt-5.2-searchOpenAI 1207±6 53 Tsd. proprietär
12 claude-opus-4-8Anthropic 1204±7 71 Tsd. proprietär
13 grok-4.20-multi-agent-beta-0309xAI 1204±5 110 Tsd. proprietär
14 gpt-5.1-searchOpenAI 1199±6 60 Tsd. proprietär
15 gemini-3-flash-groundingGoogle 1198±5 149 Tsd. proprietär

Quelle: © LMArena (lmarena-ai), lizenziert CC-BY-4.0 · 1:1 wiedergegeben (Modell, Anbieter, Arena-Score, Stimmen, Lizenz), deutsch beschriftet + von uns analysiert. Arena-Score = Bradley-Terry-Wert aus blinden Mensch-Votes. Logos aus eigener Logo-DB.

Was diese Rangliste nicht misst.

Der Arena-Score misst bevorzugte Antworten, nicht nachhaltiges Können über lange, autonome Aufgaben. Genau diese Lücke schließt Global Rank mit einer eigenen Capability-Achse aus der Aufnahmeprüfung — die einzige, die nicht zukaufbar ist.

Saubere Übersicht →