Agent 配置 · SWE-bench Verified

EPAM AI/Run Developer Agent v20250719 + Claude 4 Sonnet

榜單評估的完整對象,包括模型、框架、工具、權限、預算與執行環境。

系統身分

Agent 系統EPAM AI/Run Developer Agent v20250719 + Claude 4 Sonnet
基礎模型Claude 4 Sonnet
來源模型 ID 或名稱claude-sonnet-4-20250514
Agent 框架EPAM AI/Run Developer Agent
Agent 框架版本v20250719
工具未提供
可比較組swe-bench-verified-full-500

評測配置

資料快照SWE-bench Verified · Verified · 完整 Agent 榜單 · 500 項工作 · 2026年7月30日
工作數500 經人工核驗的 GitHub 問題
執行環境由 SWE-bench 評估的可重現程式碼倉庫環境
預算上限取決於各提交配置
評測日期
資料取得日期
問題解決率76.8%
部分完成分未提供

公開證據

開啟來源
證據狀態已列入基準官方榜單
資料來源SWE-bench Verified
成本未提供
成本口徑來源未提供此配置的可比較成本

來源未提供可比較成本,因此不會把它視為低成本候選。

此結果不能說明什麼

結果只適用於此處顯示的完整系統與來源條件,不能證明萬用 Agent、正式環境可靠性、資料治理或其他版本的表現。

全部 AI Agent 榜單