03 · 工作榜單

深度研究

多步驟分析、證據整合與有依據的結論。

官方版本
3
公開資料
2
資料截止日
為什麼選擇這些候選
優先選擇具有目前智能指數與客觀工作資料的模型,再檢查引用規範與不確定性處理。
仍需驗證的部分
榜單涵蓋不能證明來源品質、連網搜尋品質或你所在領域的事實可靠性。
起始候選

三個值得優先測試的官方版本

公開資料可以縮小範圍,但不能取代真實工作中的受控測試。 選擇兩個或三個候選,查看並列的公開資料。

0 / 3
起始候選 1

Claude Fable 5

全面可用
claude-fable-5

Anthropic綜合能力 · 3

模型官網
起始候選 2

GPT-5.6 Sol

全面可用
gpt-5.6-sol

OpenAI綜合能力 · 5

模型官網
起始候選 3

Kimi K3

全面可用
kimi-k3

Moonshot AI目前沒有對應到這個具體版本的可比較公開結果。

模型官網
全部工作榜單
公開資料不同公開資料使用不同量尺。缺漏資料不會按 0 計算,不同來源也不會合併成一個分數。

Kimi K3

目前沒有對應到這個具體版本的可比較公開結果。

這是實測起點,不是萬用冠軍選擇兩個或三個候選,查看並列的公開資料。

不同公開資料使用不同量尺。缺漏資料不會按 0 計算,不同來源也不會合併成一個分數。

榜單涵蓋不能證明來源品質、連網搜尋品質或你所在領域的事實可靠性。

系統會預選這項工作範本與前兩個已選候選;收集回答前可編輯全部工作。