07 · 工作榜單

圖像與多模態

圖像、文件、資訊擷取與圖文混合推理。

官方版本
3
公開資料
0
資料截止日:
為什麼選擇這些候選
同時考察託管與開放的多模態版本,再用你的圖像類型、解析度與輸出格式測試。
仍需驗證的部分
目前公開智能指標不是視覺專項評測,部分候選也缺少可比資料。
公開資料
綜合能力
資料截止日
起始候選

三個值得優先測試的官方版本

公開資料可以縮小範圍,但不能取代真實工作中的受控測試。

3 / 3
起始候選 1

Gemini 3.5 Flash

穩定版
gemini-3.5-flash

Google目前沒有對應到這個具體版本的可比較公開結果。

模型官網
起始候選 2

Command A Vision

穩定版
command-a-vision-07-2025

Cohere目前沒有對應到這個具體版本的可比較公開結果。

模型官網
起始候選 3

Phi-4 Multimodal Instruct

穩定版
microsoft/Phi-4-multimodal-instruct

Microsoft目前沒有對應到這個具體版本的可比較公開結果。

模型官網
公開資料不同公開資料使用不同量尺。缺漏資料不會按 0 計算,不同來源也不會合併成一個分數。

Gemini 3.5 Flash

目前沒有對應到這個具體版本的可比較公開結果。

Command A Vision

目前沒有對應到這個具體版本的可比較公開結果。

Phi-4 Multimodal Instruct

目前沒有對應到這個具體版本的可比較公開結果。

這是實測起點,不是萬用冠軍選擇兩個或三個候選,查看並列的公開資料。

不同公開資料使用不同量尺。缺漏資料不會按 0 計算,不同來源也不會合併成一個分數。

目前公開智能指標不是視覺專項評測,部分候選也缺少可比資料。

系統會預選這項工作範本與前兩個已選候選;收集回答前可編輯全部工作。