KI-Weltrangliste · Sprache · Reichweite belegt · Fähigkeit geprüft

Deutsch

Sprachmodelle, bewertet ausschließlich an Prompts auf Deutsch — wer in dieser Sprache am besten antwortet. Jede Zahl mit Quelle und Lizenz — plus eigene Analyse, die kein anderer Anbieter liefert.

Deutsch

15 Modelle · Arena-Score · Stand 2026-09-01

Sprachmodelle, bewertet ausschließlich an Prompts auf Deutsch — wer in dieser Sprache am besten antwortet.

#ModellArena-ScoreStimmenLizenz
1 gemini-3-proGoogle 1517±23 797 proprietär
2 claude-opus-5-maxAnthropic 1516±36 293 proprietär
3 claude-opus-5-highAnthropic 1507±26 546 proprietär
4 claude-opus-4-6-highAnthropic 1505±18 1 Tsd. proprietär
5 gemini-3.5-flash-mediumGoogle 1502±27 518 proprietär
6 gemini-3-flashGoogle 1497±26 564 proprietär
7 muse-sparkMeta 1495±39 235 proprietär
8 gemini-3.1-pro-previewGoogle 1492±16 2 Tsd. proprietär
9 claude-opus-4-7-highAnthropic 1490±20 970 proprietär
10 qwen3.5-max-previewAlibaba 1488±31 371 proprietär
11 claude-opus-4-6Anthropic 1488±18 1 Tsd. proprietär
12 gemini-2.5-proGoogle 1487±13 3 Tsd. proprietär
13 claude-opus-4-7Anthropic 1484±20 989 proprietär
14 gpt-5.5OpenAI 1482±21 1 Tsd. proprietär
15 qwen3.8-maxAlibaba 1481±40 197 proprietär

Quelle: © LMArena (lmarena-ai), lizenziert CC-BY-4.0 · 1:1 wiedergegeben (Modell, Anbieter, Arena-Score, Stimmen, Lizenz), deutsch beschriftet + von uns analysiert. Arena-Score = Bradley-Terry-Wert aus blinden Mensch-Votes. Logos aus eigener Logo-DB.

Was diese Rangliste nicht misst.

Der Arena-Score misst bevorzugte Antworten, nicht nachhaltiges Können über lange, autonome Aufgaben. Genau diese Lücke schließt Global Rank mit einer eigenen Capability-Achse aus der Aufnahmeprüfung — die einzige, die nicht zukaufbar ist.

Saubere Übersicht →