06 · 任务榜单

中文与多语言

中文优先写作、翻译、本地化和混合语言任务。

官方版本
3
公开数据
2
数据截止日:
为什么选择这些候选
从公开提供中文或多语言产品线的服务商开始,再用你的样本检查术语和地区表达。
仍需验证的部分
公开综合榜单不是中文专项评测,语言质量必须直接测试。
公开数据
用户偏好
数据截止日
起始候选

三个值得优先测试的官方版本

公开数据可以缩小范围,但不能代替在真实工作中的受控测试。

3 / 3
起始候选 1

Qwen 3.7 Max

稳定版
qwen3.7-max-2026-06-08

Alibaba Qwen目前没有映射到这个具体版本的可比公开结果。

模型官网
起始候选 2

Kimi K3

稳定版
kimi-k3

Moonshot AI用户偏好 · #10

模型官网
起始候选 3

DeepSeek V4 Pro

预览版
deepseek-v4-pro

DeepSeek用户偏好 · #46

模型官网
公开数据不同公开数据使用不同量尺。缺失数据不会按 0 计算,不同来源也不会被合并成一个分数。

Qwen 3.7 Max

目前没有映射到这个具体版本的可比公开结果。

Kimi K3

数据来源
LMArena
来源排名
#10
来源原始值
1486
映射核实日期

DeepSeek V4 Pro

数据来源
LMArena
来源排名
#46
来源原始值
1457
映射核实日期
这是实测起点,不是万能冠军选择两个或三个候选,查看并列的公开数据。

不同公开数据使用不同量尺。缺失数据不会按 0 计算,不同来源也不会被合并成一个分数。

公开综合榜单不是中文专项评测,语言质量必须直接测试。

系统会预选本任务模板和前两个已选候选;收集回答前可以编辑全部任务。