Google DeepMind 发布 Gemini Omni 1.1 Flash:强化生成式视频可控性
Google DeepMind推出Gemini Omni 1.1 Flash,提升了生成视频的可控性与迭代效率。
AI 深度解读
Google DeepMind 于 2026 年 8 月通过官方账号宣布推出 Gemini Omni 1.1 Flash 模型,重点提升生成式视频的可控性、迭代速度与制作级可用度,其关注价值在于推动视频生成技术由单次试探向可控生产流程演进。
- 该模型着重优化对镜头动作、时间节奏以及画面前后连贯性的精准把控,旨在缓解生成式视频在连续镜头中容易变形失真的问题。
- 配合本次更新,官方开放了在 Flow by Google 工具中的接入入口,为创作者提供实际场景的交互与试用界面。
- 结合 Google 官方技术发布信息(2026年8月),该模型具备全模态输入输出能力,支持通过自然语言指令针对画面局部进行替换与风格调整。
- 引入低分辨率草稿预览与高分辨率渲染分层,使创作者能够在正式输出前降低试错成本。
- 影响/看点:若模型在实际多镜头衔接中的控帧精度达到工业标准,可能意味着内容团队的制作与修模周期将显著缩短,而这一效果的成立取决于长镜头生成时物理规律与细节一致性的实际保持能力。
- 资料依据:
- 1. Google DeepMind 官方 X 账号(https://x.com/GoogleDeepMind/status/2093338200580256172)
- 2. Google 官方发布页面(https://deepmind.google)
本内容由 AI 生成,仅供参考,请注意甄别