Immagini e lavoro multimodale
Immagini, documenti, estrazione e ragionamento combinato visivo-testuale.
- Perché questi candidati
- Assumption · Historical. Includi opzioni multimodali gestite e aperte, quindi verifica i tipi esatti di immagini, la risoluzione e il formato di output che usi.
- Cosa rimane incerto
- L’attuale segnale sulle attività oggettive non è un benchmark dedicato alla visione e per alcuni candidati mancano dati confrontabili.
Tre versioni ufficiali da testare per prime
I dati pubblici restringono il campo. Non sostituiscono un test controllato sul tuo lavoro. Seleziona due o tre candidati per un confronto affiancato dei dati pubblici.
Unknown · Not automatically certified
Nessun risultato pubblico comparabile è attualmente associato a questa versione esatta.
Evidenza pubblicaI modelli utilizzano scale diverse di evidenze pubbliche. Le evidenze mancanti non vengono considerate pari a zero e OpenGPT non combina fonti non omogenee in un unico punteggio.+
Un punto di partenza pratico, non un vincitore universaleSeleziona due o tre candidati per un confronto affiancato dei dati pubblici.+
I modelli utilizzano scale diverse di evidenze pubbliche. Le evidenze mancanti non vengono considerate pari a zero e OpenGPT non combina fonti non omogenee in un unico punteggio.
L’attuale segnale sulle attività oggettive non è un benchmark dedicato alla visione e per alcuni candidati mancano dati confrontabili.
La valutazione si apre con questo modello predefinito di attività e i primi due modelli selezionati. Puoi modificare ogni attività prima di raccogliere le risposte.