核心看点
- 场景延伸功能:可将视频片段延长最多40秒,每次延伸约10秒,支持前后帧控制
- 4K超清输出:最终成片支持4K分辨率,画质达到商业级标准
- 360p草稿模式:速度提升60%,成本降低约2/3,适合快速迭代
- 文生视频登顶:发布后迅速拿下Text-to-Video排行榜第一
详细解析
Google在8月27日正式发布了Gemini Omni 1.1 Flash,这是其视频生成模型的重大升级。与之前的Veo相比,新版本最大的突破在于场景延伸(Scene Extension)能力——用户可以上传一段视频,让AI自动”续写”后面的画面,最长可延伸至40秒。
具体技术亮点包括:
- 上下文记忆:延伸时参考前10秒视频内容,保证画面连贯性(Veo仅约1秒)
- 首尾帧控制:可指定起始和结束画面,AI自动补全中间过程
- 视频参考:支持导入最多3秒参考视频,保持角色、风格和动作一致性
- 多比例支持:16:9横屏和9:16竖屏均可生成
在定价方面,360p草稿模式约$0.03/秒,720p约$0.10/秒,4K成品价格更高。Google将其集成到Google Flow、Gemini App和Gemini API中,覆盖从创意草稿到商业成片的完整工作流。
早期用户测试显示,该模型在动态镜头(如追车、运动场景)和写实风格上表现突出,但复杂物理交互和多镜头一致性仍需多次迭代。
总结
Gemini Omni 1.1 Flash的发布标志着Google在AI视频生成领域正式加入”长视频”赛道。场景延伸+4K输出+低成本草稿模式的组合,对短视频创作者、广告制作人和独立电影人来说都是重大利好。目前已在Google AI Plus/Pro/Ultra订阅中全球上线。
本文地址:https://www.163264.com/15295


微信扫一扫,鼓励一下~