2026年8月27日,谷歌DeepMind正式推出Gemini Omni 1.1 Flash——一款AI视频生成模型,支持从文本、图像或已有视频生成与连续编辑高分辨率视频。最高支持4K分辨率,单次以10秒为步长逐步扩展,单条视频累计最长可达40秒,支持首尾帧指定、场景扩展与参考视频一致性控制,覆盖360p至4K四档分辨率。模型已上线Google Flow、Gemini API、Vertex AI与Google AI Studio,按秒计费。
一、把生成与编辑收拢到同一模型
Gemini Omni 1.1 Flash与多数AI视频工具的核心差异在于:它把"生成"与"编辑"整合在同一模型中,而非分成生成和后期两条流水线。用户既可以从零生成视频,也能在已有片段上连续扩展与改写——这对需要快速迭代的广告分镜、产品演示和社媒短视频而言,意味着不用每次从头开始,而是在现有素材上做可控的增量创作。
场景扩展与连续生成是1.1 Flash最核心的差异化能力。用户可直接基于已有视频,从结尾处无缝衔接并继续生成后续画面,每次以10秒为步长逐步扩展,单条视频累计最长可达40秒。这种"边生成边续写"的模式,适合把短视频拉长成完整叙事,或在大模型生成后做可控续写,而非每次从零重生成。
首尾帧指定与运镜让创作者对画面起止有精确控制:只需指定镜头的起始帧与结束帧,模型即可完成平滑自然的转场与镜头运镜,减少随机生成带来的不可控感,也更便于与分镜脚本对齐。
参考视频一致性方面,可引入最长3秒的参考视频片段,依据参考内容精准维持画面的上下文背景与角色一致性,降低多镜头之间的角色与场景跳变,对系列化短视频与固定角色内容尤为重要。
高速预览与4K直出则提供了效率与质量的切换选项。在360p预览模式下,生成速度较标准720p最高提升60%,成本仅需三分之一,适合分镜脚本快速迭代;最终成片则可直出1080p或4K。
二、性能数据与定价
| 分辨率 | 每秒价格 | 单条时长 |
|---|---|---|
| 360p | $0.03 | 最长40秒 |
| 720p | $0.10 | 最长40秒 |
| 1080p | $0.15 | 最长40秒 |
| 4K | $0.30 | 最长40秒 |
Gemini Omni 1.1 Flash按秒计费,360p预览模式成本仅标准720p的三分之一,适合分镜快速迭代。单次以10秒为步长扩展,单条累计最长40秒,更长内容需自行拼接多段。Flow免费档提供每日额度,Pro/Ultra订阅可获更高配额。
在AI工具导航的框架下,Gemini Omni 1.1 Flash的定位与可灵3.0、Veo3形成直接竞品关系,但它强调"边生成边续写"的增量编辑模式,而非一次性生成长视频。与AI PPT等分镜排版工具配合使用时,它可以将静态分镜脚本快速转化为动态预览素材,大幅降低从"画面构思"到"动态验证"的沟通成本。
三、与主流视频模型的对比
| 对比维度 | Gemini Omni 1.1 Flash | 可灵3.0 | Veo3 |
|---|---|---|---|
| 最高分辨率 | 4K | 4K | 4K |
| 单条时长 | 最长40秒(10秒步长扩展) | 最长15秒(可延长) | 约8秒原生(可扩展) |
| 首尾帧/参考视频 | 支持首尾帧+3秒参考视频 | 支持参考视频与多主体锚定 | 支持参考图像首帧 |
| 360p预览 | 速度+60%、成本1/3 | 未提供 | 未提供 |
| 价格(720p) | $0.10/秒 | 约¥0.6–1.0/秒 | $0.10/秒(Fast) |
| 价格(4K) | $0.30/秒 | 约¥3.0/秒 | $0.30/秒(Fast) |
三款模型在"可控续写"与"高分辨率直出"上各有侧重。Gemini Omni 1.1 Flash以40秒累计时长、首尾帧指定与3秒参考视频强调可控的连续编辑,并用360p预览把迭代成本压到三分之一;可灵3.0在参考视频与多主体锚定上更成熟;Veo3则凭原生同步音频形成差异化。
四、应用场景与适用人群
广告与社媒短视频:用360p预览快速迭代分镜,再直出4K成片
影视预可视化:指定首尾帧生成转场与运镜,降低分镜沟通成本
产品演示:基于已有素材续写,快速产出多版本讲解视频
角色一致性内容:挂载参考视频锁定角色与场景,做系列化短视频
适用人群:广告与社媒内容团队(快速迭代分镜并以可控成本产出高分辨率成片)、影视与动画从业者(首尾帧指定与参考视频带来的镜头可控性)、产品与电商团队(基于已有素材续写快速生成多版本演示)。
五、如何使用
通过Google账号登录Flow或Google AI Studio,选择Gemini Omni模型,上传首尾帧或参考视频,设定分辨率,按10秒步长扩展至所需时长(最长40秒)即可导出。Flow免费档提供每日额度,Pro/Ultra订阅可获更高配额。模型为闭源商业模型,未开放权重,仅通过官方渠道调用,不支持自部署。360p预览模式是降低迭代成本的关键——先用低分辨率快速验证分镜逻辑,再切换到4K直出最终成片,这种"预览+成片"的分级工作流,与AI PPT中先用大纲框架再精细化排版的操作逻辑如出一辙。
