字节跳动入局世界模型竞赛:正研发实时空间视频生成模型
字节跳动正研发面向机器人与自动驾驶领域的实时空间视频生成模型,正式加入世界模型竞赛。
AI 深度解读
彭博社于 2026 年 9 月 7 日报道,字节跳动正在研发面向实时空间视频生成的 AI 模型,旨在切入具备空间一致性的三维世界模型领域。
- 架构与指标:该空间视频模型旨在实时生成具备三维一致性的互动内容,通过将算力分担至云端,目标是将延迟控制在约 0.05 秒、帧率达 20 帧/秒。
- 战略定位:世界模型已被列为字节跳动 2026 年的核心 AI 方向之一,由创始人张一鸣直接关注,并获得了重点数据预算支持。
- 业务结合:该技术建立在既有 Seedance 视频生成体系之上,计划与 Pico 扩展现实生态打通,支持用户通过语音与动作进行交互。
- 影响/看点:实时空间视频生成若取得工程突破,可能推动头显交互与虚拟场景生成,但其落地效果取决于云端推理成本与低延迟传输网络的稳定性。
- 资料依据:
- Bloomberg(2026-09-07):https://www.bloomberg.com/news/articles/2026-09-07/bytedance-founder-joins-ai-elite-in-race-to-perfect-world-models
- The Next Web(2026-09-07):https://thenextweb.com/news/bytedance-zhang-yiming-world-models-spatial-video
本内容由 AI 生成,仅供参考,请注意甄别