KI-Weltrangliste · Sprache · Reichweite belegt · Fähigkeit geprüft

Dokument-Verständnis

Modelle, die Fragen über lange Dokumente beantworten — Verträge, Tabellen, Reports. Jede Zahl mit Quelle und Lizenz — plus eigene Analyse, die kein anderer Anbieter liefert.

Dokument-Verständnis

15 Modelle · Arena-Score · Stand 2026-09-01

Modelle, die Fragen über lange Dokumente beantworten — Verträge, Tabellen, Reports.

#ModellArena-ScoreStimmenLizenz
1 claude-opus-5-highAnthropic 1520±15 2 Tsd. proprietär
2 claude-opus-4-6Anthropic 1510±6 37 Tsd. proprietär
3 claude-opus-4-6-thinkingAnthropic 1506±7 25 Tsd. proprietär
4 claude-fable-5Anthropic 1504±9 6 Tsd. proprietär
5 claude-opus-4-7Anthropic 1498±7 19 Tsd. proprietär
6 claude-opus-4-7-thinkingAnthropic 1497±7 19 Tsd. proprietär
7 gpt-5.5-highOpenAI 1485±7 17 Tsd. proprietär
8 claude-sonnet-4-6Anthropic 1483±7 54 Tsd. proprietär
9 gpt-5.5OpenAI 1480±7 17 Tsd. proprietär
10 gpt-5.6-terra-xhighOpenAI 1479±13 2 Tsd. proprietär
11 gpt-5.6-sol-xhighOpenAI 1479±17 1 Tsd. proprietär
12 claude-opus-4-8-thinkingAnthropic 1475±9 8 Tsd. proprietär
13 muse-spark-1.1Meta 1472±13 2 Tsd. proprietär
14 claude-sonnet-5-highAnthropic 1470±11 4 Tsd. proprietär
15 gpt-5.4OpenAI 1470±7 30 Tsd. proprietär

Quelle: © LMArena (lmarena-ai), lizenziert CC-BY-4.0 · 1:1 wiedergegeben (Modell, Anbieter, Arena-Score, Stimmen, Lizenz), deutsch beschriftet + von uns analysiert. Arena-Score = Bradley-Terry-Wert aus blinden Mensch-Votes. Logos aus eigener Logo-DB.

Was diese Rangliste nicht misst.

Der Arena-Score misst bevorzugte Antworten, nicht nachhaltiges Können über lange, autonome Aufgaben. Genau diese Lücke schließt Global Rank mit einer eigenen Capability-Achse aus der Aufnahmeprüfung — die einzige, die nicht zukaufbar ist.

Saubere Übersicht →