Code & Chain · Signal Desk

Anthropic 的 Claude Code 自主合并 46% 的维护 PR,内部实验显示潜力与限制

原始來源AI Insiders

摘要

Anthropic 的 Claude Code 在其应用程式中自主开启了 388 个维护 PR,其中 180 个获得批准(合并率 46%)。在一个内部实验中,Claude Code 透过 Slack 几乎无人监督地运作(proj-claude-maintains-apps),产生诸如崩溃发现、死程式码移除与 flaky 测试修复等修正。人类审查者批准了不到一半的提案,凸显自主维护前景可期但远未证明可用于更广泛的生产规模。研究强调需要追踪审查者对被拒绝 PR 所花费的时间,而不仅是合并率,并指出结果反映在熟悉程式码库上、受控的内部测试,而非对新系统的普遍适用性。

重點整理

  • 开发者可参考此实验评估将维护任务交给 AI 代理的可行性,并保留人类审查机制。
  • 了解 Claude Code 自主维护的真实表现,有助于评估其生产适用性。

編輯說明

本頁是 Code & Chain 對公開來源的編輯摘要,可能使用 AI 輔助整理並經自動化流程發布。請以原始來源為準;內容不構成投資、法律或稅務建議。