OpenGPT-RECHERCHE

Modell AI und Agenten-Nachweisindex

Diesen Index verwenden, um von einer Upstream-Quelle oder einem Anbieter zu einem exakten Modell, Agent-Produkt oder Benchmark-Datensatz zu gelangen. Jedes Ziel gibt an, was seine Evidenz abdeckt und was sie nicht nachweisen kann.

Quellen öffentlicher Rankings
2
Modellanbieter
11
Modellfamilien
13
Agent categories · Agent benchmarks
7 · 9

Nachweisumfang

Diese Seite ist ein Index vorhandener öffentlicher Evidenz und anbieterdokumentierter Identitäten. Die Aufnahme stellt weder eine Empfehlung durch OpenGPT noch einen allgemeingültigen Rang dar.

How OpenGPT handles this evidence

Der Index wird aus demselben geprüften Modellkatalog, denselben Momentaufnahmen öffentlicher Ranglisten, demselben Erstanbieter-Verzeichnis für Agent-Identitäten und denselben Benchmark-Datensätzen erzeugt, die auch für die sichtbaren Ranglisten verwendet werden.

Vergleichsgrenzen

  • Verschiedene Quellen messen unterschiedliche Gegenstände und dürfen nicht zu einem universellen Gesamtwert zusammengeführt werden.
  • Datum, Version und Konfigurationsidentität müssen geprüft werden, bevor aufgrund eines Ergebnisses gehandelt wird.
  • OpenGPT ordnet öffentliche Evidenz; es behauptet nicht, jede aufgeführte Evaluierung erneut ausgeführt zu haben.

Beleg-Hubs durchsuchen

Durchsuchen Sie OpenGPTs öffentliche Ranking-Quellen, verifizierte Anbieter, Modellfamilien, Agentenkategorien und Benchmark-Umfänge in einem zentralen, crawlbaren Forschungsindex.

  1. LMArenaQuellen öffentlicher RankingsText Style Control
  2. LiveBenchQuellen öffentlicher RankingsLiveBench-2026-06-25
  3. OpenAIModellanbieter7 Official model IDs
  4. AnthropicModellanbieter6 Official model IDs
  5. GoogleModellanbieter12 Official model IDs
  6. MetaModellanbieter5 Official model IDs
  7. DeepSeekModellanbieter2 Official model IDs
  8. Alibaba QwenModellanbieter12 Official model IDs
  9. Mistral AIModellanbieter6 Official model IDs
  10. xAIModellanbieter5 Official model IDs
  11. CohereModellanbieter8 Official model IDs
  12. MicrosoftModellanbieter5 Official model IDs
  13. Moonshot AIModellanbieter11 Official model IDs
  14. GPTModellfamilien7 Official model IDs
  15. CLAUDEModellfamilien6 Official model IDs
  16. GEMINIModellfamilien7 Official model IDs
  17. LLAMAModellfamilien3 Official model IDs
  18. MUSEModellfamilien2 Official model IDs
  19. DEEPSEEKModellfamilien2 Official model IDs
  20. QWENModellfamilien12 Official model IDs
  21. MISTRALModellfamilien6 Official model IDs
  22. GROKModellfamilien5 Official model IDs
  23. CommandModellfamilien8 Official model IDs
  24. GEMMAModellfamilien5 Official model IDs
  25. PHIModellfamilien5 Official model IDs
  26. KIMIModellfamilien11 Official model IDs
  27. ProgrammierenAgentenkategorien21 Verified products
  28. Terminal und DevOpsAgentenkategorien7 Verified products
  29. BrowserAgentenkategorien7 Verified products
  30. ComputersteuerungAgentenkategorien6 Verified products
  31. Tools und APIsAgentenkategorien7 Verified products
  32. RechercheAgentenkategorien9 Verified products
  33. Geschäftlicher ArbeitsablaufAgentenkategorien9 Verified products
  34. SWE-bench VerifiedAgenten-BenchmarksVerified · Top 10 published configurations · 500 Aufgaben
  35. Terminal-Bench 2.1Agenten-Benchmarksterminal-bench/terminal-bench-2-1 · publisher-verified leaderboard
  36. AssistantBenchAgenten-BenchmarksVon HAL verifizierter Snapshot · 33 öffentliche Aufgaben · 1 Scaffold
  37. WebArenaAgenten-Benchmarksv0.2.0 · canonical self-hosted environment
  38. OSWorld 2.0Agenten-Benchmarkstask version v2026.06.24 · 500-step budget
  39. Berkeley Function-Calling LeaderboardAgenten-BenchmarksBFCL V4 · commit f7cf735 · bfcl-eval 2025.12.17
  40. GAIAAgenten-BenchmarksHAL verified snapshot · Top 15 published configurations · public validation set · 165 questions
  41. τ²-bench CoreAgenten-Benchmarksv1.0.1 · standard agent · GPT-5.2 low user simulator · 4 trials
  42. τ³-Banking KnowledgeAgenten-Benchmarksv1.0.1 · AllTools · GPT-5.2 low user simulator · seed 300 · 4 trials