旋钮被吸进Gemini之后,先看它还记得什么
Google 放出 Gemini Omni 1.1 Flash,把视频生成和剪辑收进同一套对话式模型。Veo 上常用的 4K 超分、首尾帧、360p 快速打样都还在,真正改写工作流的是视频续镜:上下文从只看原片最后1秒,拉到完整10秒,正好十倍。
以前人走过客厅,中途换了杯子、灯暗一档,下一镜经常把道具吃掉。模型只咬住尾帧,中间发生过的事等于没发生。1.1 回头看完整10秒,杯子和光线才有机会被带进下一截。官方说法是可按10秒一段往后续,累计大约到40秒。更长的故事仍要自己分镜,不是一条指令拍完短片。

打样和成片终于能在同一条链路上倒
360p 草稿大约比 720p 更快、更便宜,公开对比是速度最高约快六成、成本约三分之一。先锁运动和首尾帧,确认镜头成立,再拉到 1080p 或 4K。过去这套常要两个模型来回倒:一个负责生成,一个负责超分。Omni 把旋钮吸到 Gemini API 里,模型代号是 gemini-omni-1.1-flash。
首尾帧插值用来补运镜:给你起幅和落幅,中间的推拉、环绕由模型填。参考视频大约还能塞进最多3秒,用来借角色或动作。音频也要在提示词里写,续镜时音乐是否接副歌、要不要切镜头,不写清楚就会自行发挥。
按秒计价,先打草稿再加分辨率
| 输出 | 大约单价 | 更适合的步骤 |
|---|---|---|
| 360p | 0.03美元/秒 | 对运动、对道具、对台词节奏 |
| 720p | 0.10美元/秒 | 确认续镜是否接得上 |
| 1080p | 0.15美元/秒 | 横屏成片、平台上传 |
| 4K | 0.30美元/秒 | 定稿超分,不适合反复试错 |
Gemini 应用里,Plus、Pro、Ultra 用户开始能用续镜;Flow 的续镜还在后续跟上。开发者走 Google AI Studio 和 Gemini API,企业可接到 Agent 平台。Veo 没有消失,Lite 和 Fast 仍按秒卖;Omni 抢的是「生成加对话剪辑」这一层,不是把所有片源生产线一次性替换。
记得住上一镜,不等于角色再也不会漂
10秒上下文解决的是短程记忆:刚换的杯子、刚暗下去的灯、刚转过的脸。它不保证40秒后衣服、发型、房间陈设仍严丝合缝。输入侧编辑和续镜最多看约10秒视频,输出单段大约3到10秒。要把客厅一场戏接到门口一场戏,还是得在提示词里写清「同一批角色切到下一场」,并准备参考图。
视频模型开始比谁记得住上一镜。续镜不再是 Veo 页面上的专属开关,而成了 Gemini 对话里的一句 Continue the scene。制作人该改的是习惯:先用360p把连续性打穿,再为4K付钱。谁还把续镜当成某一款产品的独家功能,账会先亏在反复重绘的那几秒上。