07 · 任务榜单

图像与多模态

图像、文档、信息提取和图文混合推理。

官方版本
3
公开数据
0
数据截止日:
为什么选择这些候选
同时考察托管和开放的多模态版本,再用你的图像类型、分辨率和输出格式测试。
仍需验证的部分
当前公开智能指标不是视觉专项评测,部分候选也缺少可比数据。
公开数据
综合能力
数据截止日
起始候选

三个值得优先测试的官方版本

公开数据可以缩小范围,但不能代替在真实工作中的受控测试。

3 / 3
起始候选 1

Gemini 3.5 Flash

稳定版
gemini-3.5-flash

Google目前没有映射到这个具体版本的可比公开结果。

模型官网
起始候选 2

Command A Vision

稳定版
command-a-vision-07-2025

Cohere目前没有映射到这个具体版本的可比公开结果。

模型官网
起始候选 3

Phi-4 Multimodal Instruct

稳定版
microsoft/Phi-4-multimodal-instruct

Microsoft目前没有映射到这个具体版本的可比公开结果。

模型官网
公开数据不同公开数据使用不同量尺。缺失数据不会按 0 计算,不同来源也不会被合并成一个分数。

Gemini 3.5 Flash

目前没有映射到这个具体版本的可比公开结果。

Command A Vision

目前没有映射到这个具体版本的可比公开结果。

Phi-4 Multimodal Instruct

目前没有映射到这个具体版本的可比公开结果。

这是实测起点,不是万能冠军选择两个或三个候选,查看并列的公开数据。

不同公开数据使用不同量尺。缺失数据不会按 0 计算,不同来源也不会被合并成一个分数。

当前公开智能指标不是视觉专项评测,部分候选也缺少可比数据。

系统会预选本任务模板和前两个已选候选;收集回答前可以编辑全部任务。