关注我们: 微信公众号

扫码关注我们

AI 造 AI:Claude 26% 研发已由 Claude“主导”

AI头条 2026-09-18 5

2026 年 9 月 17 日,Anthropic 首次公布内部 AI 研发自动化数据:截至 2026 年 8 月,Claude 已经能够“主导”26% 的 AI 研发工作,而今年 2 月这一比例还不到 1%。

2.png

超过 90% 的 AI 研发工作中,Claude 至少已经达到与人类“协作”的水平。

这里的“主导”并不是简单写代码或辅助搜索。

Anthropic 采用 Epoch AI 提出的自动化等级,将 AI 参与研发划分为从 AL0 到 AL5 六个等级。

1)AL3 为“协作”,AI 可以在人类密切指导下完成大块工作;

2)AL4 为“主导”,人类只需要给出高层目标并监督,AI 可以端到端完成大部分任务;

3)AL5 则代表完全自主,不再需要人类参与。

目前 Claude 已有 26% 的研发工作达到 AL4,但还没有任何一类被 Anthropic 认定为 AL5。人类仍然没有退出研发流程。

真正值得关注的是增长速度。

3.jpg

2026 年 2 月,Claude“主导”的研发工作占比还不到 1%,到 8 月已经升至 26%。

Anthropic 在图表中按照当前趋势外推,如果这一速度延续,到 2026 年底,这一比例可能接近 80%。

Anthropic CEO Dario Amodei 此前反复讨论的“递归式自我改进”,正在出现更加具体的数据支撑。

所谓递归式自我改进,是 AI 参与研发下一代 AI,新模型能力提高后,再参与研发更强的下一代模型,由此形成不断加速的研发循环。

Anthropic 表示,目前 AI 尚未达到“完全自主研发自己继任者”的阶段,但越来越多 AI 研发已经交给 Claude。

Anthropic 此前还披露,截至 2026 年 5 月,其代码库中超过 80% 的合并代码由 Claude 编写;2026 年第二季度,典型工程师每天合并的代码量已经达到 2024 年的约 8 倍。Anthropic 同时提醒,代码行数并不能直接等同于生产力提升。

这套研发体系的规模也已经相当大。

截至 8 月,在 Anthropic 使用最广泛的内部研发和工程平台上,任意时刻约有 3 万个 AI Agent 同时运行,负责研究和工程工作。

Anthropic 称,这些 Agent 的所有操作都会经过在线监控系统。

8 月期间,Anthropic 分析了这些 AI Agent 超过 10 亿次决策,其中约 0.002% 被实时监控系统阻止,相当于每约 4.7 万次决策中有一次被拦截。离线监控系统每周还会筛出约 10 万份记录进一步检查,其中最高优先级的约 50 项会提交人工审查。

Anthropic 还首次披露了算力分配情况。

在其统计的一周内,用于 AI 研发的算力中约 6% 被归类为安全研究;如果只看“AI 参与 AI 研发”所使用的算力,安全研究占比约为 12%。Anthropic 称,这一统计采取了较保守的计算方式,同时没有计入安全分类器消耗的另一部分算力。

为了计算 26% 这一数字,Anthropic 抽取了参与模型研发循环各部门约 20% 的员工,通过 Slack 和内部文档整理出约 1.5 万项具体研发任务,再将其归纳为 542 个任务节点,其中包含 378 个最底层任务类别。Claude 随后分析每一类工作的自动化程度,另一个 Claude 模型负责独立评级。

Anthropic 也承认,这套方法存在局限。

其中一个问题是“Claude 评 Claude”。

任务分析和自动化等级判断本身也使用了 Claude,因此可能产生一致性的系统偏差。此外,“协作”和“主导”的边界本身也存在主观判断。

Anthropic 表示,未来计划引入独立第三方,对这些内部数据和评估流程进行验证。

云头条声明:如以上内容有误或侵犯到你公司、机构、单位或个人权益,请联系我们说明理由,我们会配合,无条件删除处理。

关键词:

网友留言2

未查询到任何数据!
◎欢迎您留言咨询,请在这里提交您想咨询的内容。