TL;DR 太长不看
谷歌于 2026 年 8 月 27 日推出 Gemini Omni 1.1 Flash 视频生成模型。
该模型最高可输出 4K 视频,支持从已有视频结尾无缝扩展、指定首尾帧生成转场,并提供更快的 360p 预览模式。
Gemini Omni 1.1 Flash 是 Google 推出的视频生成模型,定位在电影级镜头扩展与高分辨率最终成片之间。
用户提供一段已有视频,可以让模型从结尾继续生成后续画面。
用户也可以只给出首尾帧,由模型补出中间运镜与转场。
谷歌把这组能力拆成两条线。
一条是快速验证线,360p 预览模式比标准 720p 生成速度最高提升 60%,成本仅为三分之一,适合分镜脚本和早期创意迭代。
另一条是最终交付线,最高可直接输出 4K 视频,也支持 1080p 与 720p 成片。
By the Numbers 关键数字
- 发布时间:2026 年 8 月 27 日。
- 最高分辨率:4K。
- 扩展步长:每次可按 10 秒为单位扩展已有视频。
- 累计时长:单条视频最长可扩展到 40 秒。
- 参考视频:可引入最长 3 秒的视频片段作为画面与角色一致性参考。
- 360p 预览:速度较 720p 标准模式最高提升 60%,成本为三分之一。
- 价格:360p 为 0.03 美元/秒,720p 为 0.1 美元/秒,1080p 为 0.15 美元/秒,4K 为 0.3 美元/秒。按当前汇率约合人民币 0.2 元至 2 元/秒。
主要能力
场景扩展让用户从已有视频的结尾继续生成后续画面。
按每次 10 秒逐步推进,最终累计最长可达 40 秒。
指定首尾帧后,模型会自动补出从起始镜头到结束镜头的平滑转场与运镜,减少手动拆镜头的工作量。
360p 预览主打快速出片。
它以更低分辨率先验证创意,渲染速度更快、费用更低,适合反复调整分镜。
视频参考则把最长 3 秒的参考片段输入模型,帮助维持场景背景和角色外观在连续生成中的一致性。
谁会更先用上
广告与短视频团队可以用 360p 预览快速过方案,再输出 1080p 或 4K 成片交付客户。
影视前期制作中,分镜师可以用首尾帧功能补全关键镜头之间的过渡。
游戏与虚拟制作团队则可以利用参考视频锁定角色形象,降低跨镜头一致性的维护成本。
对比定位
| 维度 | Gemini Omni 1.1 Flash | OpenAI Sora | Luma Dream Machine |
|---|---|---|---|
| 最高分辨率 | 最高 4K | 1080p | 1080p |
| 视频扩展 | 支持从结尾按 10 秒步长扩展 | 支持视频到视频与扩展 | 支持延长与循环 |
| 首尾帧控制 | 支持指定起始与结束帧 | 支持参考图片生成 | 支持首帧图片引导 |
| 快速预览 | 360p 预览成本约 720p 的三分之一 | 无单独低分辨率预览 | 无单独低分辨率预览 |
| 适用阶段 | 分镜验证到最终交付 | 长视频创意生成 | 短视频快速生成 |
表内信息来自公开报道与官方文档,实际能力以各平台为准。
常见问题
问 Gemini Omni 1.1 Flash 是什么
它是谷歌推出的视频生成模型,支持 4K 输出、视频扩展、首尾帧转场和 360p 快速预览。
问 最高能生成什么规格
最高支持 4K 分辨率,同时支持 1080p、720p 和 360p。
问 价格是多少
360p 为 0.03 美元/秒,720p 为 0.1 美元/秒,1080p 为 0.15 美元/秒,4K 为 0.3 美元/秒。
问 视频扩展最长多久
可以按每次 10 秒的方式扩展,单条视频累计最长可达 40 秒。
问 与直接用文本生成视频有什么不同
该模型除了文生视频,还强调对已有视频的控制,包括从结尾继续生成、指定首尾帧和参考视频一致性。
问 什么时候可用
谷歌于 2026 年 8 月 27 日宣布推出,具体面向用户的开放时间需参考 Google AI 平台公告。
来源说明
信息来自 IT之家报道、谷歌官方新闻稿及公开技术资料。
采集时间为 2026-08-29。