Beeld- en multimodaal werk
Afbeeldingen, documenten, extractie en gemengde visueel-tekstuele redenering.
- Waarom deze kandidaten
- Assumption · Historical. Neem beheerde en open multimodale opties op en test vervolgens precies de beeldtypen, resolutie en uitvoerindeling die u gebruikt.
- Wat blijft onzeker
- Het Actuele signaal voor objectieve taken is geen specifieke visionbenchmark en voor sommige kandidaten ontbreken vergelijkbare gegevens.
Drie officiële versies om eerst te testen
Openbare gegevens beperken het veld. Ze vervangen geen gecontroleerde test met uw eigen werk. Selecteer twee of drie kandidaten voor een vergelijking van openbare gegevens naast elkaar.
Unknown · Not automatically certified
Er is momenteel geen vergelijkbaar openbaar resultaat aan deze exacte versie gekoppeld.
Openbaar bewijsDe modellen gebruiken verschillende openbare bewijsschalen. Ontbrekend bewijs wordt niet als nul behandeld en OpenGPT combineert ongelijksoortige bronnen niet tot één score.+
Een praktisch uitgangspunt, geen universele winnaarSelecteer twee of drie kandidaten voor een vergelijking van openbare gegevens naast elkaar.+
De modellen gebruiken verschillende openbare bewijsschalen. Ontbrekend bewijs wordt niet als nul behandeld en OpenGPT combineert ongelijksoortige bronnen niet tot één score.
Het Actuele signaal voor objectieve taken is geen specifieke visionbenchmark en voor sommige kandidaten ontbreken vergelijkbare gegevens.
De evaluatie opent met dit taaksjabloon en de eerste twee geselecteerde modellen. U kunt elke taak bewerken voordat u antwoorden verzamelt.