Trabalho com imagens e multimodal
Imagens, documentos, extração e raciocínio combinado sobre texto e conteúdo visual.
- Por que estes candidatos
- Assumption · Historical. Inclua opções multimodais gerenciadas e abertas e depois teste os tipos exatos de imagem, a resolução e o formato de saída que você usa.
- O que permanece incerto
- O sinal atual de tarefas objetivas não é um benchmark dedicado de visão, e alguns candidatos não têm dados comparáveis.
Três versões oficiais para testar primeiro
Os dados públicos delimitam as opções. Eles não substituem um teste controlado no seu próprio trabalho. Selecione dois ou três candidatos para comparar dados públicos lado a lado.
Unknown · Not automatically certified
No momento, nenhum resultado público comparável está mapeado para esta versão exata.
Evidência públicaOs modelos usam escalas diferentes de evidências públicas. Evidências ausentes não são tratadas como zero, e o OpenGPT não combina fontes distintas em uma só pontuação.+
Um ponto de partida prático, não um vencedor universalSelecione dois ou três candidatos para comparar dados públicos lado a lado.+
Os modelos usam escalas diferentes de evidências públicas. Evidências ausentes não são tratadas como zero, e o OpenGPT não combina fontes distintas em uma só pontuação.
O sinal atual de tarefas objetivas não é um benchmark dedicado de visão, e alguns candidatos não têm dados comparáveis.
A avaliação é aberta com este modelo de tarefa e os dois primeiros modelos selecionados. Você pode editar todas as tarefas antes de coletar respostas.