谷歌 Gemini Omni 1.1 Flash 上线视频续写与场景扩展功能
谷歌 Gemini Omni 1.1 Flash 新增视频续写功能,支持基于已有视频继续扩展场景并生成长视频。
AI 深度解读
谷歌旗下 Gemini 团队通过官方渠道发布了 Gemini Omni 1.1 Flash 模型的视频续写与场景扩展功能,支持创作者在已有视频的结尾处继续延展生成新镜头,提升了多模态模型在连续叙事生成中的可用性。
- 支持按 10 秒递增方式对视频进行延展,单条视频生成总时长可达 40 秒。
- 该模型改变了以往仅参考片段末尾单帧或单秒的做法,能够分析前序最多 10 秒的视频画面,以维持主体形象、光影与运动轨迹的连贯。
- 配套首尾帧插值过渡与最多 3 秒的参考视频输入功能,便于创作者控制特定运镜轨迹并保留关键视觉特征。
- 支持生成 360p 快速草稿与 4K 超分辨率导出,并在 Google AI Studio 和 Gemini 订阅端面向开发者及订阅用户开放。
- 影响/看点:该功能意味着生成式视频正从单次短镜头片段生成逐步转向可控的分镜连续创作,但其实际效果的稳定发挥仍取决于复杂运动场景中长时序前后一致性的保持程度与算力生成成本。
- 资料依据:
- 1. Google 官方 X 账号(GeminiApp,2026年8月):https://x.com/GeminiApp/status/2093107727363092677
- 2. Google 官方博客(Google Blog,2026年8月):https://blog.google/
本内容由 AI 生成,仅供参考,请注意甄别