起始候選 1
穩定版Claude Sonnet 5
claude-sonnet-5Anthropic使用者偏好 · #38
清楚、安全並符合政策的常見要求回覆。
公開資料可以縮小範圍,但不能取代真實工作中的受控測試。
claude-sonnet-5Anthropic使用者偏好 · #38
gpt-5.6-terraOpenAI目前沒有對應到這個具體版本的可比較公開結果。
command-a-plus-05-2026Cohere目前沒有對應到這個具體版本的可比較公開結果。
目前沒有對應到這個具體版本的可比較公開結果。
目前沒有對應到這個具體版本的可比較公開結果。
不同公開資料使用不同量尺。缺漏資料不會按 0 計算,不同來源也不會合併成一個分數。
公開偏好資料不會測試你的政策、系統整合、語言組合或監管義務。
系統會預選這項工作範本與前兩個已選候選;收集回答前可編輯全部工作。