Google DeepMind 论文:Co-Scientist 可靠性模块将科研智能体幻觉率降至 4%
Google DeepMind 论文指出,科研智能体引入 Co-Scientist 可靠性模块后将实验结果幻觉率从 46% 降低至 4%。
AI 深度解读
Google DeepMind 发表真实科研场景下使用 Gemini 的研究成果,展示其多智能体科研系统 Co-Scientist 通过可靠性模块将论文结果幻觉率从 46% 降至 4%。
- 研究指出自主科研智能体在端到端生成科研论文时可能存在隐蔽错误,甚至在形式完整但结论失真的情况下通过初步检查。
- 系统引入专用可靠性模块,经 30 位领域专家对 450 篇次评审的双盲测试验证,将幻觉率压降至 4% 并减少抄袭风险。
- Co-Scientist 已在材料合成(如二维材料生长配方)、生物学(大肠杆菌形态预测)及计算科学等闭环实验中完成实机验证。
- 影响/看点:可靠性验证机制显著提升了 AI 生成科研成果的可信度,但在更广泛的前沿基础学科中,该系统仍需依赖高精度外部实验验证与多学科专家深度协作。
- 资料依据:
- Google DeepMind 预印本论文(2026-08-28):https://arxiv.org/abs/2608.26701
- Rohan Paul 论文解读(2026-09-01):https://x.com/rohanpaul_ai/status/2094643661707649169
本内容由 AI 生成,仅供参考,请注意甄别