Code & Chain · Signal Desk

Anthropic 的 Claude Code 自主合併 46% 的維護 PR,內部實驗顯示潛力與限制

原始來源AI Insiders

摘要

Anthropic 的 Claude Code 在其應用程式中自主開啟了 388 個維護 PR,其中 180 個獲得批准(合併率 46%)。在一個內部實驗中,Claude Code 透過 Slack 幾乎無人監督地運作(proj-claude-maintains-apps),產生諸如崩潰發現、死程式碼移除與 flaky 測試修復等修正。人類審查者批准了不到一半的提案,凸顯自主維護前景可期但遠未證明可用於更廣泛的生產規模。研究強調需要追蹤審查者對被拒絕 PR 所花費的時間,而不僅是合併率,並指出結果反映在熟悉程式碼庫上、受控的內部測試,而非對新系統的普遍適用性。

重點整理

  • 開發者可參考此實驗評估將維護任務交給 AI 代理的可行性,並保留人類審查機制。
  • 了解 Claude Code 自主維護的真實表現,有助於評估其生產適用性。

編輯說明

本頁是 Code & Chain 對公開來源的編輯摘要,可能使用 AI 輔助整理並經自動化流程發布。請以原始來源為準;內容不構成投資、法律或稅務建議。