起始候选 1
稳定版Grok 4.5
grok-4.5xAI单位成功任务成本 · #1
不只看单价,降低每次成功任务的总成本。
公开数据可以缩小范围,但不能代替在真实工作中的受控测试。
grok-4.5xAI单位成功任务成本 · #1
gpt-5.6-lunaOpenAI单位成功任务成本 · #5
gemini-3.5-flashGoogle单位成功任务成本 · #9
不同公开数据使用不同量尺。缺失数据不会按 0 计算,不同来源也不会被合并成一个分数。
公开价格和工作负载会变化;不同服务商的 Token 统计及你的成功标准也不同。
系统会预选本任务模板和前两个已选候选;收集回答前可以编辑全部任务。