Gemini Omni 1.1 Flash 上线:可续写 40 秒、指定首尾帧、支持 4K 升级

Gemini Omni 1.1 Flash 上线:可续写 40 秒、指定首尾帧、支持 4K 升级

2026 年 8 月 27 日,Google AI Studio 官方账号发布长帖,宣布 Gemini Omni 1.1 Flash 上线。核心定位不是“再出一个能生成视频的模型”,而是把 Omni 从可玩的生成能力,推进到更接近专业制作流程的可控视频生产。

下面按“可直接改稿”的结构整理。

一句话结论

Omni 1.1 Flash 把生成视频补成了一条更完整的工作流:低成本草稿 → 关键帧控制 → 场景续写 → 参考视频约束 → 1080p/4K 成片。单段仍是 3–10 秒,不是一次生成 40 秒 4K。

这次更新在解决什么问题

上一版 Omni Flash 的卖点是:文本/图像/视频多模态输入、自然语言对话式剪辑、带世界知识的生成。

1.1 的重点变成四件事:

  1. 更长、更稳的叙事续写
  2. 更像导演工具的镜头控制
  3. 更快、更便宜的原型迭代
  4. 更接近交付规格的分辨率

官方说法是:让生成视频“更可控、更快试错、更适合真正部署”。

五项新能力(写稿可直接用)

1. 场景续写(Scene Extension)

  • 可在已有视频结尾继续生成,过渡尽量无缝。
  • 续写时会读取最多 前 10 秒 上下文;旧版基本只看最后 1 秒。
  • 每次续写 10 秒,累计最长 40 秒
  • 为了接得顺,原片末尾若干帧可能被改掉。
  • 续写时仍建议明确写:动作怎么走、镜头怎么切、音乐/对白是否延续。

写作提示:标题里如果写“支持 40 秒视频”,务必加限定——是“10 秒一段、累计到 40 秒”,不是单次出片。

2. 首尾帧插值(First / Last Frame)

给定起始帧和结束帧,模型生成中间连续运动。适合:

  • 环绕运镜
  • 推拉变焦
  • 循环片段
  • 指定起幅/落幅的转场

这是从“描述画面”走向“指定镜头起止点”。

3. 360p 草稿模式

  • 用 360p 快速出预览。
  • 官方称比标准 720p 最高快约 60%,成本约 1/3
  • 适合分镜、故事板、平台内快速试错。
  • 确认方案后再升到 1080p 或 4K。

4. 升到 1080p / 4K

可输出更接近成片的 1080p 或 4K。注意:多家报道和文档口径都指向 4K 是升级/放大后的交付分辨率,默认生成仍以 720p 为主,不要写成“原生一次生成电影级 4K 长片”。

5. 视频参考(Video Reference)

多模态输入里可加入最多 3 秒 参考视频,用来保持角色、场景、运动风格一致。输入视频用于编辑/续写时上限约 10 秒

技术规格(适合做信息盒)

项目内容
模型名gemini-omni-1.1-flash
输入文本、图像、视频
输出视频(含原生音频能力)
单段时长3–10 秒
帧率24 FPS
分辨率360p / 720p / 1080p / 4K
画幅常见 16:9、9:16
续写累计最长 40 秒
参考视频最多约 3 秒
编辑/续写输入视频最多约 10 秒
接口形态Interactions API,可多轮对话式修改

怎么用、对谁开放

开发者侧:

  • Google AI Studio 可直接试用
  • Gemini API
  • Gemini Enterprise Agent Platform(企业)
  • 文档、Cookbook、Prompt Guide 已同步更新

消费者侧:

  • Google AI Plus / Pro / Ultra 用户,可在 Google Flow 使用 Omni 1.1
  • Gemini App 已对上述订阅用户开放场景续写

合作落地(官方点名):Adobe Firefly、Figma Weave、Runway、GMI Cloud 等,方向是把“生成一段视频”变成“在工具里持续导演、分支、引用、升分辨率”。

价格口径(可作参考,建议文中标注来源)

第三方整理的官方价目大致为(美元 / 秒):

  • 360p:$0.03
  • 720p:$0.10
  • 1080p:$0.15
  • 4K:$0.30

和 Veo 3.1 系列比,Omni 1.1 的差异更在“对话式控制 + 续写/关键帧/参考视频”,不只是单价。发文前最好再核对 Google 博客价表,因为官方页有时只放图不放纯文本。

和旧版 Omni Flash 的本质差别

旧版:能从多种输入生成视频,并能用自然语言改。
新版:开始补齐制作链路里最缺的三块——

  1. 时间轴变长:靠续写堆到 40 秒
  2. 镜头可指定:首尾帧,而不只靠文字猜运镜
  3. 成本可分层:先 360p 试,再高分辨率交付

一句话:从“生成器”往“可编排的视频工作台”挪了一步。

写文章时建议强调的边界

避免夸大的四句话:

  1. 不是一次生成 40 秒成片,是 10 秒一段往后续。
  2. 4K 更像成片升级,不等于内部原生按 4K 直接生成全部细节。
  3. 一致性提升来自“看前 10 秒 + 参考视频”,不是保证角色永不崩。
  4. 专业可用,但仍是生成+控制工具,不是完整剪辑台替代品。

可直接用的更新导语

Google 于 8 月 27 日推出 Gemini Omni 1.1 Flash,面向开发者和订阅用户补齐生成视频的制作控制:可读取前 10 秒上下文并按 10 秒一段续写至累计 40 秒,支持首尾帧插值、最多 3 秒参考视频、360p 低成本草稿,以及 1080p/4K 升级。模型已进入 Google AI Studio、Gemini API、Google Flow 和 Gemini App。

建议标题方向

  • 《Gemini Omni 1.1 Flash 上线:生成视频开始能“续戏、定首尾帧、出 4K”》
  • 《不是一次生成 40 秒:Google 把 AI 视频做成可迭代的制作流》
  • 《从能生成到能导演:Omni 1.1 对 Flow / AI Studio 意味着什么》

官方源帖:https://x.com/GoogleAIStudio/status/2093020771245346930
配套博客:https://blog.google/innovation-and-ai/technology/developers-tools/build-with-gemini-omni-1-1-flash/
开发文档:https://ai.google.dev/gemini-api/docs/omni

如果你原文章是评测、教程还是产品对比,把旧稿主题发我,我可以按同一事实再改一版可直接发布的成稿。

本文地址:https://www.163264.com/15311

(0)
AI日报:腾讯开源770B模型Hy4preview;Midjourney V8.2上线图像编辑;谷歌Gemini Omni 1.1登场
上一篇 1天前
下一篇 14小时前

相关推荐