KI-Weltrangliste · Sprache · Reichweite belegt · Fähigkeit geprüft

Vision & Multimodal

Modelle, die ein Bild sehen und darüber sprechen — Diagramme lesen, Fotos beschreiben, Dokumente interpretieren. Jede Zahl mit Quelle und Lizenz — plus eigene Analyse, die kein anderer Anbieter liefert.

Vision & Multimodal

15 Modelle · Arena-Score · Stand 2026-09-01

Modelle, die ein Bild sehen und darüber sprechen — Diagramme lesen, Fotos beschreiben, Dokumente interpretieren.

#ModellArena-ScoreStimmenLizenz
1 claude-fable-5Anthropic 1329±9 10 Tsd. proprietär
2 claude-opus-5-highAnthropic 1322±8 8 Tsd. proprietär
3 claude-opus-4-7Anthropic 1317±7 21 Tsd. proprietär
4 claude-opus-4-7-highAnthropic 1316±7 21 Tsd. proprietär
5 claude-opus-4-6-highAnthropic 1315±7 21 Tsd. proprietär
6 qwen3.8-maxAlibaba 1313±8 7 Tsd. proprietär
7 claude-opus-4-6Anthropic 1311±7 25 Tsd. proprietär
8 gemini-3.5-flash-highGoogle 1311±9 8 Tsd. proprietär
9 muse-sparkMeta 1306±10 6 Tsd. proprietär
10 gemini-3.5-flash-mediumGoogle 1306±8 8 Tsd. proprietär
11 gemini-3-proGoogle 1304±8 13 Tsd. proprietär
12 muse-spark-1.2 (xHigh)Meta 1304±15 2 Tsd. proprietär
13 gemini-3.6-flash-highGoogle 1302±11 4 Tsd. proprietär
14 gpt-5.4-highOpenAI 1298±7 23 Tsd. proprietär
15 glm-5.3-flashZ.ai 1296±17 1 Tsd. offen

Quelle: © LMArena (lmarena-ai), lizenziert CC-BY-4.0 · 1:1 wiedergegeben (Modell, Anbieter, Arena-Score, Stimmen, Lizenz), deutsch beschriftet + von uns analysiert. Arena-Score = Bradley-Terry-Wert aus blinden Mensch-Votes. Logos aus eigener Logo-DB.

Was diese Rangliste nicht misst.

Der Arena-Score misst bevorzugte Antworten, nicht nachhaltiges Können über lange, autonome Aufgaben. Genau diese Lücke schließt Global Rank mit einer eigenen Capability-Achse aus der Aufnahmeprüfung — die einzige, die nicht zukaufbar ist.

Saubere Übersicht →