起始候選 1
穩定版Grok 4.5
grok-4.5xAI單位成功工作成本 · #1
不只看單價,降低每次成功工作的總成本。
公開資料可以縮小範圍,但不能取代真實工作中的受控測試。
grok-4.5xAI單位成功工作成本 · #1
gpt-5.6-lunaOpenAI單位成功工作成本 · #5
gemini-3.5-flashGoogle單位成功工作成本 · #9
不同公開資料使用不同量尺。缺漏資料不會按 0 計算,不同來源也不會合併成一個分數。
公開價格與工作負載會變化;不同服務商的 Token 統計及你的成功標準也不同。
系統會預選這項工作範本與前兩個已選候選;收集回答前可編輯全部工作。