微软研究:无主管编程智能体团队规模越大,任务表现越好

📡 Rohan Paul2026-10-05 11:30

微软研究发现,无中央管理者的编程智能体团队规模越大,任务得分越高、完成越快。

AI 深度解读

微软等作者于2026-09-22提交的论文《Agensh》研究了没有中央协调者的编程智能体团队,关注价值在于它把“增加智能体数量”作为软件任务中的一种扩展维度。

  • 论文设计了共享工作区、消息接口和共享上下文,让智能体自行认领子任务、交换结果、验证并合并进展。
  • 在五个最难的ProgramBench任务上,团队从1个扩展到128个智能体时,平均最终测试通过率由19.31%升至28.78%。
  • 论文还报告,在pandoc任务上,智能体数量从1个增至1024个时,最终测试通过率由33.89%升至55.06%。
  • 这些结果使用同一模型GPT-5.6-sol,论文摘要未给出大规模团队的推理成本、资源占用和工程维护代价。
  • 影响/看点:研究意味着并行协作可能改善复杂编程任务的完成率和延迟,但结论能否转化为实际生产收益,取决于任务可分解程度、合并冲突、调用成本和质量评测能否保持稳定。
  • 资料依据:
  • arXiv《Agensh: Scaling Organizational Intelligence to 1,024 Agents》(2026-09-22):https://arxiv.org/abs/2609.26781
  • X:Rohan Paul(2026-10-05):https://x.com/rohanpaul_ai/status/2106950188011258367

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com →
AI 助手