英伟达首款专为智能体打造的 CPU「Vera」正式出货
英伟达首款专为 AI 智能体设计的处理器「Vera」已正式开始向客户出货。
AI 深度解读
英伟达于2026年8月27日更新公告,确认面向智能体工作负载设计的 Vera CPU 已开始向 AWS 等合作方交付;该消息的关注价值在于,AI 智能体的运行瓶颈不仅涉及 GPU 推理,也涉及工具调用、任务编排、数据搬运和沙盒管理等 CPU 环节。
- 英伟达称 Vera 采用 88 个定制 Olympus 核心,内存带宽为每秒1.2TB,并宣称在智能体 AI 工作负载上单核性能最高可达传统方案的1.8倍。
- 公告列出的适用任务包括工具调用、强化学习、数据分析、智能体沙盒和长上下文状态管理,强调的是持续并发任务,而非单一模型推理峰值。
- AWS 已收到首台 Vera CPU 服务器;此前英伟达还向 Oracle Cloud Infrastructure、Anthropic、OpenAI 和 SpaceXAI 交付系统,但交付不等同于大规模商用部署。
- 英伟达称 Vera 可作为 Vera Rubin NVL72 的主机处理器,并通过 NVLink-C2C 与 GPU 协同工作,显示其定位是整机架构的一部分。
- 1.8倍性能和2倍能效等数字来自英伟达自身公告,尚缺少统一基准、工作负载细节和第三方测试,因此不宜直接外推到所有智能体场景。
- 影响/看点:如果云厂商能在真实智能体任务中验证性能和成本优势,专用 CPU 可能改变 AI 基础设施的采购组合;成立条件是软件栈适配、供货规模、价格以及相对通用 CPU 的总拥有成本都具备竞争力。
- 资料依据:NVIDIA Blog《Delivering Vera: NVIDIA’s First CPU Built for Agents Is Shipping Now》,2026年5月18日发布、8月27日更新,https://blogs.nvidia.com/blog/vera-cpu-delivery/
本内容由 AI 生成,仅供参考,请注意甄别