Hugging Face 联手 Baseten 与 Goodfire 推进开源模型安全与可解释性研究

📡 Thomas Wolf(Hugging Face 联创/CSO)2026-09-17 04:53

Hugging Face 联手 Baseten 与 Goodfire 合作,将开源模型安全与可解释性控制集成至推理基建。

AI 深度解读

Hugging Face 宣布与模型推理平台 Baseten 旗下 Baselabs 及可解释性机构 Goodfire 达成合作,将模型内部表征与安全干预机制直接嵌入开源推理基础设施。

  • Hugging Face 联合创始人 Thomas Wolf 于 2026 年 9 月 16 日公布该合作,主张开源与安全部署能够并存。
  • 合作内容涵盖策略对齐训练、运行时故障监控,以及将可解释性信号接入实时干预控制系统。
  • 相关安全控制能力将直接部署于 Baseten 的推理服务中,计划面向其平台所有客户开放。
  • 影响/看点:此举意味着开源模型安全正从离线评测走向运行时动态干预阶段,但其商业化落地效果取决于干预机制对推理吞吐量与时延带来的额外开销。
  • 资料依据:
  • X(Thomas Wolf)(2026-09-16):https://x.com/Thom_Wolf/status/2100327168421277779
  • Baseten(2026-09-16):https://www.baseten.co/blog/open-source-safety-goodfire-hugging-face

本内容由 AI 生成,仅供参考,请注意甄别

查看原文 ↗
看实时 AI 热点雷达 实时信息流 · 事件聚类 · 订阅推送 —— 完整产品在 aihot.aicxd.com
AI 助手