LMArena
Die vollständige aktuelle Gesamtrangliste mit Stilkontrolle, basierend auf Nutzern, die zwei Modellantworten direkt miteinander vergleichen.
- Veröffentlichungsdatum der Rangliste
- 2. Sept. 2026
- Erfasst am
- 9. Sept. 2026
- Lizenz
- CC BY 4.0
Unabhängige Modellentscheidungen
Exakte Modellversionen anhand öffentlicher Evidenz in die engere Auswahl nehmen, sie auf einheitlicher Grundlage vergleichen und die Wahl anschließend mit Ihrer eigenen Aufgabe überprüfen.
OpenGPT ordnet und präsentiert öffentlich veröffentlichte Bewertungsdaten Dritter; die Modelle wurden nicht erneut getestet. Nutzen Sie das Ranking, um die relative Leistung einzuordnen, und prüfen Sie Kandidaten anschließend mit Ihren eigenen Aufgaben.
Mit der anstehenden Entscheidung beginnen. Jedes Szenario öffnet das relevanteste veröffentlichte Rankingsignal. Originalquelle und Skala bleiben sichtbar.
Zeigt alle veröffentlichten Einträge mit Quellen-Modell-ID oder Quellenname einschließlich Aliasnamen und Konfigurationen. Die Quellenränge bleiben erhalten.
Objektive Aufgaben. LiveBench-Gesamtbewertung über 23 objektiv bewertete Aufgaben in sieben Kategorien.
10 von 10 angezeigt. Objektive Aufgaben.
Ranking-Grundlage
Ranking-Grundlage
Bewertungen bleiben auf den ursprünglichen Skalen der Herausgeber. Sie werden nicht zu einer Gesamtbewertung zusammengeführt.
Fehlende Daten bedeuten nicht null. Sie bedeuten, dass der Herausgeber diese Kennzahl für diesen Snapshot nicht angegeben hat.
Wenn eine Quelle Modelleinstellungen meldet, gilt die Platzierung für genau diese Konfiguration und Quellversion – nicht für jede Aufgabe, Region oder Bereitstellung.
Kein Anbieter kann für eine Platzierung bezahlen. OpenGPT verlinkt direkt auf die verwendeten Belege.
Ranking-Grundlage
Die vollständige aktuelle Gesamtrangliste mit Stilkontrolle, basierend auf Nutzern, die zwei Modellantworten direkt miteinander vergleichen.
Dreiundzwanzig objektive Aufgaben in sieben Kategorien; die Fragen werden alle sechs Monate aktualisiert.
Methodenversion
Aktualisierungen von LMArena und LiveBench werden erst nach Prüfungen auf Schema, Vollständigkeit, Datum, Integrität und Anomalien automatisch veröffentlicht. Pausierte Quellen bleiben historisch.
Fasst wichtige Änderungen bei Rang, Modellen und Quellen in einem prüfbaren Update zusammen.
Friert einen datierten Snapshot mit exakten Konfigurationen, Quellenständen und Korrekturen ein.