KI-Weltrangliste · Branche · Reichweite belegt · Fähigkeit geprüft

Medizin & Gesundheit

Wie schlagen sich Sprachmodelle bei Aufgaben aus dem Bereich „Medizin & Gesundheit"? Diese Rangliste filtert auf berufsfeld-typische Prompts. Jede Zahl mit Quelle und Lizenz — plus eigene Analyse, die kein anderer Anbieter liefert.

Medizin & Gesundheit

15 Modelle · Arena-Score · Stand 2026-09-01

Wie schlagen sich Sprachmodelle bei Aufgaben aus dem Bereich „Medizin & Gesundheit"? Diese Rangliste filtert auf berufsfeld-typische Prompts.

#ModellArena-ScoreStimmenLizenz
1 claude-opus-5-maxAnthropic 1516±18 1 Tsd. proprietär
2 muse-spark-1.2 (xHigh)Meta 1515±39 232 proprietär
3 qwen3.8-maxAlibaba 1511±21 858 proprietär
4 claude-opus-5-highAnthropic 1507±13 3 Tsd. proprietär
5 claude-opus-4-6-highAnthropic 1506±9 5 Tsd. proprietär
6 claude-opus-4-6Anthropic 1501±9 6 Tsd. proprietär
7 qwen3.5-max-previewAlibaba 1500±16 2 Tsd. proprietär
8 claude-opus-4-7-highAnthropic 1497±10 4 Tsd. proprietär
9 gemini-3-proGoogle 1492±12 3 Tsd. proprietär
10 gemini-3.5-flash-highGoogle 1492±13 3 Tsd. proprietär
11 glm-5.3-maxZ.ai 1492±26 553 offen
12 claude-opus-4-7Anthropic 1490±10 5 Tsd. proprietär
13 ernie-5.1Baidu 1488±12 3 Tsd. proprietär
14 gemini-3.1-pro-previewGoogle 1485±8 8 Tsd. proprietär
15 kimi-k3-maxMoonshot 1483±18 1 Tsd. offen

Quelle: © LMArena (lmarena-ai), lizenziert CC-BY-4.0 · 1:1 wiedergegeben (Modell, Anbieter, Arena-Score, Stimmen, Lizenz), deutsch beschriftet + von uns analysiert. Arena-Score = Bradley-Terry-Wert aus blinden Mensch-Votes. Logos aus eigener Logo-DB.

Was diese Rangliste nicht misst.

Der Arena-Score misst bevorzugte Antworten, nicht nachhaltiges Können über lange, autonome Aufgaben. Genau diese Lücke schließt Global Rank mit einer eigenen Capability-Achse aus der Aufnahmeprüfung — die einzige, die nicht zukaufbar ist.

Saubere Übersicht →