Gemini Omni 1.1 Flash发布:AI视频生成进入「场景延伸」时代,支持4K输出

核心看点

  • 场景延伸功能:可将视频片段延长最多40秒,每次延伸约10秒,支持前后帧控制
  • 4K超清输出:最终成片支持4K分辨率,画质达到商业级标准
  • 360p草稿模式:速度提升60%,成本降低约2/3,适合快速迭代
  • 文生视频登顶:发布后迅速拿下Text-to-Video排行榜第一

详细解析

Google在8月27日正式发布了Gemini Omni 1.1 Flash,这是其视频生成模型的重大升级。与之前的Veo相比,新版本最大的突破在于场景延伸(Scene Extension)能力——用户可以上传一段视频,让AI自动”续写”后面的画面,最长可延伸至40秒。

具体技术亮点包括:

  • 上下文记忆:延伸时参考前10秒视频内容,保证画面连贯性(Veo仅约1秒)
  • 首尾帧控制:可指定起始和结束画面,AI自动补全中间过程
  • 视频参考:支持导入最多3秒参考视频,保持角色、风格和动作一致性
  • 多比例支持:16:9横屏和9:16竖屏均可生成

在定价方面,360p草稿模式约$0.03/秒,720p约$0.10/秒,4K成品价格更高。Google将其集成到Google Flow、Gemini App和Gemini API中,覆盖从创意草稿到商业成片的完整工作流。

早期用户测试显示,该模型在动态镜头(如追车、运动场景)和写实风格上表现突出,但复杂物理交互和多镜头一致性仍需多次迭代。

总结

Gemini Omni 1.1 Flash的发布标志着Google在AI视频生成领域正式加入”长视频”赛道。场景延伸+4K输出+低成本草稿模式的组合,对短视频创作者、广告制作人和独立电影人来说都是重大利好。目前已在Google AI Plus/Pro/Ultra订阅中全球上线。

本文地址:https://www.163264.com/15295

(0)
上一篇 14小时前
下一篇 14小时前

相关推荐