Token 调用量半年涨 6 倍,华为:运力已成 AI 算力最大瓶颈
华为披露:近半年AI token消耗量增长6倍,运力已取代芯片制程成为AI算力最大瓶颈。
AI 深度解读
华为在与互联网行业媒体的沟通会上抛出一个反常识判断:当下AI算力最大的瓶颈不是芯片制程,而是网络传输能力,这背后是token消耗量半年暴涨6倍的现实压力。
- 数据冲击:过去半年token消耗量增长6倍,模型调用次数增长约50至100倍,增速远超行业适配能力,催生了普遍存在的AI转型焦虑
- 瓶颈判断:华为中国政企互联网行业总经理黄健认为,算力、存力、运力三者中运力最突出,主张网算存协同一体化,而不是执着于单芯片制程
- 技术动作:华为已将NPO带宽提升8倍以上,token产生效率提升5倍,依托星河AI数据中心网络和昇腾超节点,从硬件、软件、调度、生态四层协同降低分布式通信损耗
- 服务分层:面向头部互联网大厂配备专属团队和百余人复合型工程师做贴身服务,中小企业则联合生态伙伴提供标准化架构规划和7×24运维
- 生态投入:投入几千人参与主流开源软件适配及社区治理路标规划,试图从底层降低大模型训推、迁移落地的门槛
- 当算力竞赛的焦点从「芯片多强」转向「网络多宽」,华为押注的是系统级基础设施能力而非单点硬件参数,这会影响未来数据中心建设和云厂商的采购逻辑。
本内容由 AI 生成,仅供参考,请注意甄别