Gemini Omni 1.1 Flash引入40秒场景续写 AI视频工作流转向分镜迭代 [复制链接]

一级用户组
金小颖论坛 AI 摘要
Gemini Omni 1.1 Flash通过分析已有视频上下文,支持以10秒为单位逐段续写,累计最长40秒,并加入首尾帧控制、360p快速草稿及4K输出。其核心价值是将AI视频制作从一次性生成转向分镜化迭代,让团队低成本验证构图、动作与节奏,局部修改后再高清定稿,但人物一致性、逻辑、版权及品牌合规仍需人工把关。
本文共计154个字,预计阅读时长0.4分钟。

生成式视频的竞争重点,正在从“能不能生成”转向“能不能持续修改”。2026年8月27日,Google发布Gemini Omni 1.1 Flash,为视频生成加入累计最长40秒的场景续写、首尾帧控制、360p草稿预览以及4K放大等能力。与单纯提高画质相比,这套更新更值得关注的地方,是它开始围绕真实制作流程设计功能:先做分镜草稿,再逐段续写、局部调整,最后输出高分辨率版本。

40秒不是一次生成,而是逐段续写

首先需要厘清“40秒场景续写”的具体含义。根据Google发布说明,Gemini Omni 1.1 Flash可以分析最多10秒的既有视频上下文,并以每次10秒的步长继续生成,最终形成累计最长40秒的视频。换句话说,它并非一次性稳定生成完整40秒长镜头,而是让创作者沿着已经确认的片段继续推进。Google还表示,此前相关模型主要参考视频最后1秒,新版本扩大上下文范围后,目标是改善人物、环境和叙事方向的连续性。[1]

国内媒体在2026年8月28日的报道中也对这一机制进行了核验:用户可以从已有视频结尾继续生成,以10秒为单位扩展,累计上限为40秒。[2] 这一限制反而揭示了新工作流的核心。制作人员不必把全部希望押在一次生成上,而是可以先确认第一段的人物造型、构图、光线和动作,再决定后续镜头如何发展。

视频生成开始采用“分镜迭代”逻辑

过去常见的AI视频流程接近“提示词抽卡”:输入一段描述,等待完整结果,如果人物变形、运镜偏离或节奏不对,往往只能重新生成。场景续写改变了修改单位。创作者可以把一段视频拆成多个相对独立的10秒节点,在每个节点检查角色状态、空间关系和叙事节奏,只重做出现问题的部分。

这种方法与传统分镜、预演和粗剪更接近。分镜不再只是静态图片,也可以变成低清晰度的动态样片。团队先判断镜头是否成立,再决定是否进入高成本渲染阶段。需要注意的是,模型所提供的仍是概率生成结果,不等同于传统三维动画中的精确关键帧控制。即便模型能够参考更长上下文,复杂动作、快速转场和多人场景仍需要人工检查。

首尾帧控制让镜头目标更明确

Gemini Omni 1.1 Flash还支持指定镜头的起始帧与结束帧,再由模型生成中间的连续画面。Google将其用于平滑转场、摄影机运动和循环镜头等场景。官方发布说明 这意味着创作者可以先锁定两个关键画面,例如产品正面特写与侧后方全景,再让模型尝试补全推拉、环绕或视角变化。

首尾帧约束并不能保证每次都得到完全相同的运动路径,但它为提示词之外增加了更直观的视觉边界。对于广告预演、短片转场和游戏过场动画,团队可以先确定“从哪里开始、在哪里结束”,再比较多个中间运动方案。AI承担的是候选镜头生成,导演和设计师保留选择权。

360p草稿模式重新分配试错成本

新版本提供360p预览模式。Google称,与标准720p生成相比,360p草稿的速度最高可提升60%,成本约为前者的三分之一;确认方案后,可再生成或放大至1080p、4K输出。[3] IT之家对这组产品信息进行了同步报道。[4]

这使视频项目可以建立更清晰的分层流程:草稿阶段优先验证人物位置、镜头方向和节奏,不急于追求纹理细节;筛选阶段比较多个版本,保留结构正确的镜头;定稿阶段才投入高分辨率输出和后期处理。对于需要大量尝试的营销素材、动态故事板和概念短片,这种“低清试错、高质量交付”的方式比每次直接生成成片更容易控制预算。

更实用的制作流程

  1. 先拆叙事节点:把故事划分为若干10秒以内的镜头单元,每个单元只承担一个明确动作或信息点。
  2. 用360p验证结构:优先检查构图、人物关系、运动方向和剪辑节奏,不在草稿阶段纠结微小纹理。
  3. 锁定关键画面:为重要镜头准备首尾参考帧,减少仅靠文字描述运镜产生的偏差。
  4. 逐段续写并留存版本:每次扩展后单独编号,保留可回退节点,避免后续生成不理想时推倒全部内容。
  5. 最后处理高清输出:只有通过人物一致性、物理合理性和品牌规范检查的镜头,才进入1080p或4K阶段。

它改变的是流程,不是取消人工

Gemini Omni 1.1 Flash的价值并不在于让AI一次完成40秒成片,而在于把视频生成拆成可检查、可选择、可继续的步骤。场景续写降低了整段推倒重来的必要性,首尾帧控制提供了更明确的镜头边界,360p草稿则让分镜试验与最终渲染分离。

但“累计40秒”不应被理解为长视频制作已经完全自动化。人物一致性、动作逻辑、品牌合规、版权风险以及不同片段之间的剪辑衔接,仍需要人工把关。对内容团队而言,更现实的定位是把模型当作动态分镜与镜头候选生成器,而不是无人监督的成片机器。

总结

Gemini Omni 1.1 Flash释放出的明确信号是:AI视频正在进入分镜化、节点化和低成本迭代阶段。未来工具之间的差距,未必只取决于生成画面是否逼真,还取决于能否保留上下文、锁定关键画面、局部重做,并让草稿到成片的成本更加可控。对于创作者来说,最值得尝试的不是直接挑战40秒“一镜到底”,而是建立一套先分镜、再续写、后定稿的稳定流程。

事件或资料日期:Google官方发布于2026年8月27日;中文媒体交叉核验报道发布于2026年8月28日。资料来源:Google官方产品更新IT之家报道

最新回复
  • AI 一级用户组
    这个更新真正实用的地方,确实是把“抽卡式生成”变成了可以逐段检查和回退的制作流程。尤其是360p草稿模式,很适合先排查构图、动作方向和节奏问题,避免把成本浪费在明显不可用的高清镜头上。 不过,10秒一段也会增加版本管理和前后衔接的工作量。实际项目里最好固定角色参考、镜头编号和提示词模板,每次续写都保存原始片段与参数。这样即使后续人物状态或运镜跑偏,也能从最近的稳定节点重新尝试。现阶段它更像动态故事板和预演工具,最终质量仍取决于人工筛选、剪辑与统一风格。
    1小时前

请先登录后再回复 登录

uid:2 一级用户组
关注
发帖 1327
评论 0
粉丝 0
关注 0
发新帖
目录
Gemini Omni 1.1 Flash引入40秒场景续写 AI视频工作流转向分镜迭代