Anthropic 披露内部研发自动化数据:Claude 主导超两成研发工作
Anthropic 首次披露内部自动化数据,显示 2026 年 8 月 Claude 已主导 26% 的被测研发工作。
AI 深度解读
Anthropic 首次公开其内部研发自动化评估指标,披露 Claude 模型在自身软件工程与研发流程中的深度参与程度,反映出头部 AI 实验室利用自身模型加速产品迭代的现状。
- Anthropic 设立了研发自动化指数(AL1 至 AL5 级别),其中 Claude 在 2026 年 8 月主导(AL4 级别:人类监督下端到端完成大部分任务)了 26% 被测内部研发任务,远高于 2026 年 2 月不足 1% 的水平。
- 在被测工作中,AI 协作及以上级别(AL3 及以上)的任务占比超过 90%,但目前尚未有任务达到完全自主(AL5 级别)。
- 内部主力开发平台上常态化运行约 3 万个研发与工程 Agent,且约 6% 的研发算力专门分配给安全性与对齐评估。
- 影响/看点:这表明头部大模型企业正在形成由 AI 辅助构建下一代 AI 的研发飞轮,可能显著缩短模型迭代周期,但其安全边界依然高度依赖严格的自动化监控和人工兜底机制。
- 资料依据:
- Anthropic 官方公告(2026-09-18):https://www.anthropic.com/research/measuring-internal-rd-automation
- Quartz(2026-09-18):https://qz.com/anthropic-claude-ai-internal-rd-automation-metrics-1851652431
本内容由 AI 生成,仅供参考,请注意甄别