Images et travail multimodal
Images, documents, extraction et raisonnement combinant éléments visuels et texte.
- Pourquoi ces candidats
- Assumption · Historical. Incluez des options multimodales gérées et ouvertes, puis testez les types d’images, la résolution et le format de sortie exacts que vous utilisez.
- Ce qui reste incertain
- L’indicateur actuel lié aux objectifs et aux tâches n’est pas un benchmark dédié à la vision, et certains candidats ne disposent pas de données comparables.
Trois versions officielles à tester en priorité
Les données publiques réduisent le champ des possibilités. Elles ne remplacent pas un test contrôlé sur vos propres tâches. Sélectionnez deux ou trois candidats pour une comparaison côte à côte des données publiques.
Unknown · Not automatically certified
Aucun résultat public comparable n’est actuellement associé à cette version exacte.
Preuve publiqueLes modèles utilisent différentes échelles de preuves publiques. Les preuves manquantes ne sont pas assimilées à zéro et OpenGPT ne combine pas des sources différentes en un seul score.+
Un point de départ pratique, pas un gagnant universelSélectionnez deux ou trois candidats pour une comparaison côte à côte des données publiques.+
Les modèles utilisent différentes échelles de preuves publiques. Les preuves manquantes ne sont pas assimilées à zéro et OpenGPT ne combine pas des sources différentes en un seul score.
L’indicateur actuel lié aux objectifs et aux tâches n’est pas un benchmark dédié à la vision, et certains candidats ne disposent pas de données comparables.
L’évaluation s’ouvre avec ce modèle de tâche et les deux premiers modèles sélectionnés. Vous pouvez modifier chaque tâche avant de recueillir les réponses.