
2026 年 8 月 27 日,Google AI Studio 官方账号发布长帖,宣布 Gemini Omni 1.1 Flash 上线。核心定位不是“再出一个能生成视频的模型”,而是把 Omni 从可玩的生成能力,推进到更接近专业制作流程的可控视频生产。
下面按“可直接改稿”的结构整理。
一句话结论
Omni 1.1 Flash 把生成视频补成了一条更完整的工作流:低成本草稿 → 关键帧控制 → 场景续写 → 参考视频约束 → 1080p/4K 成片。单段仍是 3–10 秒,不是一次生成 40 秒 4K。
这次更新在解决什么问题
上一版 Omni Flash 的卖点是:文本/图像/视频多模态输入、自然语言对话式剪辑、带世界知识的生成。
1.1 的重点变成四件事:
- 更长、更稳的叙事续写
- 更像导演工具的镜头控制
- 更快、更便宜的原型迭代
- 更接近交付规格的分辨率
官方说法是:让生成视频“更可控、更快试错、更适合真正部署”。
五项新能力(写稿可直接用)
1. 场景续写(Scene Extension)
- 可在已有视频结尾继续生成,过渡尽量无缝。
- 续写时会读取最多 前 10 秒 上下文;旧版基本只看最后 1 秒。
- 每次续写 10 秒,累计最长 40 秒。
- 为了接得顺,原片末尾若干帧可能被改掉。
- 续写时仍建议明确写:动作怎么走、镜头怎么切、音乐/对白是否延续。
写作提示:标题里如果写“支持 40 秒视频”,务必加限定——是“10 秒一段、累计到 40 秒”,不是单次出片。
2. 首尾帧插值(First / Last Frame)
给定起始帧和结束帧,模型生成中间连续运动。适合:
- 环绕运镜
- 推拉变焦
- 循环片段
- 指定起幅/落幅的转场
这是从“描述画面”走向“指定镜头起止点”。
3. 360p 草稿模式
- 用 360p 快速出预览。
- 官方称比标准 720p 最高快约 60%,成本约 1/3。
- 适合分镜、故事板、平台内快速试错。
- 确认方案后再升到 1080p 或 4K。
4. 升到 1080p / 4K
可输出更接近成片的 1080p 或 4K。注意:多家报道和文档口径都指向 4K 是升级/放大后的交付分辨率,默认生成仍以 720p 为主,不要写成“原生一次生成电影级 4K 长片”。
5. 视频参考(Video Reference)
多模态输入里可加入最多 3 秒 参考视频,用来保持角色、场景、运动风格一致。输入视频用于编辑/续写时上限约 10 秒。
技术规格(适合做信息盒)
| 项目 | 内容 |
|---|---|
| 模型名 | gemini-omni-1.1-flash |
| 输入 | 文本、图像、视频 |
| 输出 | 视频(含原生音频能力) |
| 单段时长 | 3–10 秒 |
| 帧率 | 24 FPS |
| 分辨率 | 360p / 720p / 1080p / 4K |
| 画幅 | 常见 16:9、9:16 |
| 续写累计 | 最长 40 秒 |
| 参考视频 | 最多约 3 秒 |
| 编辑/续写输入视频 | 最多约 10 秒 |
| 接口形态 | Interactions API,可多轮对话式修改 |
怎么用、对谁开放
开发者侧:
- Google AI Studio 可直接试用
- Gemini API
- Gemini Enterprise Agent Platform(企业)
- 文档、Cookbook、Prompt Guide 已同步更新
消费者侧:
- Google AI Plus / Pro / Ultra 用户,可在 Google Flow 使用 Omni 1.1
- Gemini App 已对上述订阅用户开放场景续写
合作落地(官方点名):Adobe Firefly、Figma Weave、Runway、GMI Cloud 等,方向是把“生成一段视频”变成“在工具里持续导演、分支、引用、升分辨率”。
价格口径(可作参考,建议文中标注来源)
第三方整理的官方价目大致为(美元 / 秒):
- 360p:$0.03
- 720p:$0.10
- 1080p:$0.15
- 4K:$0.30
和 Veo 3.1 系列比,Omni 1.1 的差异更在“对话式控制 + 续写/关键帧/参考视频”,不只是单价。发文前最好再核对 Google 博客价表,因为官方页有时只放图不放纯文本。
和旧版 Omni Flash 的本质差别
旧版:能从多种输入生成视频,并能用自然语言改。
新版:开始补齐制作链路里最缺的三块——
- 时间轴变长:靠续写堆到 40 秒
- 镜头可指定:首尾帧,而不只靠文字猜运镜
- 成本可分层:先 360p 试,再高分辨率交付
一句话:从“生成器”往“可编排的视频工作台”挪了一步。
写文章时建议强调的边界
避免夸大的四句话:
- 不是一次生成 40 秒成片,是 10 秒一段往后续。
- 4K 更像成片升级,不等于内部原生按 4K 直接生成全部细节。
- 一致性提升来自“看前 10 秒 + 参考视频”,不是保证角色永不崩。
- 专业可用,但仍是生成+控制工具,不是完整剪辑台替代品。
可直接用的更新导语
Google 于 8 月 27 日推出 Gemini Omni 1.1 Flash,面向开发者和订阅用户补齐生成视频的制作控制:可读取前 10 秒上下文并按 10 秒一段续写至累计 40 秒,支持首尾帧插值、最多 3 秒参考视频、360p 低成本草稿,以及 1080p/4K 升级。模型已进入 Google AI Studio、Gemini API、Google Flow 和 Gemini App。
建议标题方向
- 《Gemini Omni 1.1 Flash 上线:生成视频开始能“续戏、定首尾帧、出 4K”》
- 《不是一次生成 40 秒:Google 把 AI 视频做成可迭代的制作流》
- 《从能生成到能导演:Omni 1.1 对 Flow / AI Studio 意味着什么》
官方源帖:https://x.com/GoogleAIStudio/status/2093020771245346930
配套博客:https://blog.google/innovation-and-ai/technology/developers-tools/build-with-gemini-omni-1-1-flash/
开发文档:https://ai.google.dev/gemini-api/docs/omni
如果你原文章是评测、教程还是产品对比,把旧稿主题发我,我可以按同一事实再改一版可直接发布的成稿。
本文地址:https://www.163264.com/15311


微信扫一扫,鼓励一下~