起始候选 1
稳定版GPT-5.6 Luna
gpt-5.6-lunaOpenAI单位成功任务成本 · #5
高吞吐分类、提取、路由和短回复任务。
公开数据可以缩小范围,但不能代替在真实工作中的受控测试。
gpt-5.6-lunaOpenAI单位成功任务成本 · #5
gemini-3.1-flash-liteGoogle目前没有映射到这个具体版本的可比公开结果。
deepseek-v4-flashDeepSeek目前没有映射到这个具体版本的可比公开结果。
目前没有映射到这个具体版本的可比公开结果。
目前没有映射到这个具体版本的可比公开结果。
不同公开数据使用不同量尺。缺失数据不会按 0 计算,不同来源也不会被合并成一个分数。
OpenGPT 目前没有覆盖所有服务商的可比延迟历史。
系统会预选本任务模板和前两个已选候选;收集回答前可以编辑全部任务。