视频生成和剪辑被收进同一句对话
Google 把 Gemini Omni 1.1 Flash 定位成面向开发者的多模态AI视频生成与剪辑模型。文案里列的能力很整齐:续镜、指定镜头起幅和落幅、加入视频参考、把中意的一条拉到4K、先用360p快速试想法。旋钮不再散落在 Veo 工具条上,而是进了 Gemini API 和 AI Studio 的对话流程。
续镜是这条更新里最能改习惯的一项。模型回头看原片更长的上文,官方把可分析的先前片段拉到约10秒,再按约10秒一段往后续,累计大约到40秒。客厅里刚换的杯子、刚暗一档的灯,才有机会被带进下一截,而不是只咬住最后一帧把道具吃掉。

五件控件,对应五种制作动作
指定首尾帧,用来补运镜:你提供起幅和落幅,中间的推、拉、环绕由模型填。视频参考大约还能塞进最多3秒,用来借角色外形或动作节奏。360p 草稿公开对比大约比720p更快、更便宜,适合先锁运动再加分辨率。4K 超分放在定稿,不适合拿来反复试错。
提示词仍要写声音。续镜时音乐是否接副歌、要不要切到下一场同一批角色,不写清楚就会自行发挥。输入侧用于编辑和续镜的视频大约也有10秒上限,输出单段大约3到10秒。更长的故事仍要自己分镜。
先打样,再为清晰度付钱
| 能力 | 用来干什么 | 别指望它单独完成什么 |
|---|---|---|
| 续镜 | 把上一镜的道具和光线接下去 | 拍完一部短片、角色永不漂 |
| 首尾帧 | 控制起幅落幅和镜头运动 | 自动分好一场戏的全部机位 |
| 视频参考 | 带入已有人物或动作 | 用3秒参考替代完整资产库 |
| 360p打样 | 低成本验证节奏 | 直接当发行成片 |
| 4K超分 | 给已锁定的镜头加清晰度 | 用高分辨率掩盖连续性错误 |
按秒计价的公开数字大约是:360p每秒0.03美元,720p每秒0.10美元,1080p每秒0.15美元,4K每秒0.30美元。Gemini 应用向 Plus、Pro、Ultra 用户放开;Flow 的续镜还在后续跟上。开发者走 Google AI Studio,企业可接到 Agent 平台。Veo 的 Lite 与 Fast 仍在按秒卖,Omni 抢的是生成加对话剪辑这一层。
控件变全,验收标准反而更短
模型开始比谁记得住上一镜,并不等于服装、房间陈设在40秒后仍严丝合缝。更稳的用法是:360p验证续镜是否接得上,首尾帧锁住运镜,参考视频只用来钉住关键角色,最后才把钱花在4K上。能力清单可以一次看完,成片仍然要人看两遍道具有没有消失。