PixVerse 正式发布 R2 实时世界模型,支持实时提示词控制与交互
PixVerse发布R2实时世界模型,支持通过文本提示词实时控制、编辑虚拟场景与交互角色。
AI 深度解读
PixVerse 推出新一代实时世界模型 R2,将 AI 视频从单次固定片段生成拓展为具备持续状态记忆与实时交互的音视频流。
- 状态记忆与持久性:R2 模型引入运行状态持久化机制,用户的提示词、动作与音频输入会持续更新世界状态并在后续画面中保留。
- 多模态控制:系统支持方向键(WASD)移动控制、文本提示词修改、音频与视觉参考等多模态指令的实时响应。
- 技术架构:采用 Omni Causal AR 架构与少步数加速生成技术,以兼顾低延迟实时响应与画面连贯性。
- 影响/看点:若模型在长会话交互中能维持画面一致性与物理规律稳定性,可能为 AI 原生交互式娱乐与动态模拟提供新的技术路径,但其实际应用受限于实时推理算力成本及极端视角的退化控制。
- 资料依据:
- X:PixVerse(2026-09-22):https://x.com/PixVerse/status/2102404266484989983
- PixVerse 官方文档(2026-09-22):https://pixverse.ai/blog/r2-real-time-world-model
本内容由 AI 生成,仅供参考,请注意甄别