Dokument-Verständnis
15 Modelle · Arena-Score · Stand 2026-09-01Modelle, die Fragen über lange Dokumente beantworten — Verträge, Tabellen, Reports.
| # | Modell | Arena-Score | Stimmen | Lizenz |
|---|---|---|---|---|
| 1 | claude-opus-5-highAnthropic | 1520±15 | 2 Tsd. | proprietär |
| 2 | claude-opus-4-6Anthropic | 1510±6 | 37 Tsd. | proprietär |
| 3 | claude-opus-4-6-thinkingAnthropic | 1506±7 | 25 Tsd. | proprietär |
| 4 | claude-fable-5Anthropic | 1504±9 | 6 Tsd. | proprietär |
| 5 | claude-opus-4-7Anthropic | 1498±7 | 19 Tsd. | proprietär |
| 6 | claude-opus-4-7-thinkingAnthropic | 1497±7 | 19 Tsd. | proprietär |
| 7 | gpt-5.5-highOpenAI | 1485±7 | 17 Tsd. | proprietär |
| 8 | claude-sonnet-4-6Anthropic | 1483±7 | 54 Tsd. | proprietär |
| 9 | gpt-5.5OpenAI | 1480±7 | 17 Tsd. | proprietär |
| 10 | gpt-5.6-terra-xhighOpenAI | 1479±13 | 2 Tsd. | proprietär |
| 11 | gpt-5.6-sol-xhighOpenAI | 1479±17 | 1 Tsd. | proprietär |
| 12 | claude-opus-4-8-thinkingAnthropic | 1475±9 | 8 Tsd. | proprietär |
| 13 | muse-spark-1.1Meta | 1472±13 | 2 Tsd. | proprietär |
| 14 | claude-sonnet-5-highAnthropic | 1470±11 | 4 Tsd. | proprietär |
| 15 | gpt-5.4OpenAI | 1470±7 | 30 Tsd. | proprietär |
Quelle: © LMArena (lmarena-ai), lizenziert CC-BY-4.0 · 1:1 wiedergegeben (Modell, Anbieter, Arena-Score, Stimmen, Lizenz), deutsch beschriftet + von uns analysiert. Arena-Score = Bradley-Terry-Wert aus blinden Mensch-Votes. Logos aus eigener Logo-DB.
Was diese Rangliste nicht misst.
Der Arena-Score misst bevorzugte Antworten, nicht nachhaltiges Können über lange, autonome Aufgaben. Genau diese Lücke schließt Global Rank mit einer eigenen Capability-Achse aus der Aufnahmeprüfung — die einzige, die nicht zukaufbar ist.