10 · 任务榜单

高速生产工作流

高吞吐分类、提取、路由和短回复任务。

官方版本
3
公开数据
1
数据截止日:
为什么选择这些候选
从官方高速或轻量版本开始,再在你的地区测量延迟、吞吐、重试和格式有效性。
仍需验证的部分
OpenGPT 目前没有覆盖所有服务商的可比延迟历史。
公开数据
单位成功任务成本
数据截止日
起始候选

三个值得优先测试的官方版本

公开数据可以缩小范围,但不能代替在真实工作中的受控测试。

3 / 3
起始候选 1

GPT-5.6 Luna

稳定版
gpt-5.6-luna

OpenAI单位成功任务成本 · #5

模型官网
起始候选 2

Gemini 3.1 Flash-Lite

稳定版
gemini-3.1-flash-lite

Google目前没有映射到这个具体版本的可比公开结果。

模型官网
起始候选 3

DeepSeek V4 Flash

预览版
deepseek-v4-flash

DeepSeek目前没有映射到这个具体版本的可比公开结果。

模型官网
公开数据不同公开数据使用不同量尺。缺失数据不会按 0 计算,不同来源也不会被合并成一个分数。

GPT-5.6 Luna

数据来源
LiveBench
来源排名
#5
来源原始值
$0.202
映射核实日期

Gemini 3.1 Flash-Lite

目前没有映射到这个具体版本的可比公开结果。

DeepSeek V4 Flash

目前没有映射到这个具体版本的可比公开结果。

这是实测起点,不是万能冠军选择两个或三个候选,查看并列的公开数据。

不同公开数据使用不同量尺。缺失数据不会按 0 计算,不同来源也不会被合并成一个分数。

OpenGPT 目前没有覆盖所有服务商的可比延迟历史。

系统会预选本任务模板和前两个已选候选;收集回答前可以编辑全部任务。