Anthropic公布内部研发度量:AI已主导26%的模型研发工作
Anthropic公布内部指标,透露其已有26%的模型研发工作由AI主导,同时在线运行着3万个研发智能体。
AI 深度解读
Anthropic 首次公布追踪前沿模型研发进度的内部度量指标,为公众与监管机构评估 AI 自主研发程度提供了量化参照体系。
- Anthropic 于 2026 年 9 月 17 日发布官方报告,公开了研发自动化程度、智能体监督情况与算力分配三项内部测量指标。
- 截至 2026 年 8 月,Claude 在 Anthropic 内部主导了 26% 的模型研发任务(AL4 级别,由人类设定目标并监督),超过 90% 的研发任务有 AI 参与协作,但完全自主运作(AL5)占比为 0%。
- 在其核心内部平台上,常态化运行约 30000 个研究与工程智能体,所有动作均经过实时监控,实时阻断率约为 0.002%,离线监控系统每周筛选高风险记录并升级人工复核。
- 算力分配统计显示,在选定抽样周期内,约 6% 的 AI 研发算力及 12% 的 AI 自主研发算力被专门投入到安全性与对齐研究中。
- 影响/看点:前沿实验室公开内部研发自动化与安全算力占比,意味着行业透明度评估体系逐步从模型能力测试扩展至生产流程监控,其指标的行业参考价值取决于第三方独立审计机制的引入与跨机构统一标准的建立。
- 资料依据:
- Anthropic(2026-09-17):https://www.anthropic.com/institute/measuring-pace-of-ai-development
- X:AI Safety Memes(2026-09-18):https://x.com/AISafetyMemes/status/2100777215571169584
本内容由 AI 生成,仅供参考,请注意甄别