Gemini Omni 1.1 Flash - 谷歌推出的多模态视频生成模型

Lovart

Gemini Omni 1.1 Flash是什么

Géminis Omni 1.1 Flash 是 Google DeepMind 推出的多模态视频生成模型,面向开发者与专业创作者。模型在 Gemini Omni 初版基础上,将可分析的上下文从 1 秒延长到 10 秒,通过三档分辨率,360p 预览 / 1080p 成片 / 4K 放大和按秒计费的方式,覆盖从分镜草稿到成品交付的完整制作链路。

Gemini Omni 1.1 Flash - 谷歌推出的多模态视频生成模型

Gemini Omni 1.1 Flash的功能特色

  • 视频续写(Scene Extension):模型能"记住"已有片段的前后情节,从当前画面结尾自然往后生成,每次推进 10 秒,一条内容最多接长到 40 秒,做连续剧情短片不用反复拼凑提示词。
  • 首尾帧锁定:只需提供第一帧和最后一帧的画面,模型自动补全中间的过渡动作与镜头调度,类似给动画师"关键帧"让它补间。
  • 参考视频模式:上传一段最长 3 秒的片段,模型会提取其中人物长相、动作节奏、环境风格,在新镜头中延续这些特征,解决 AI 视频最头疼的"角色变脸"问题。
  • 草稿优先模式:360p 画质出片速度比 720p 快约 60%,价格只有三分之一,用于快速看效果、调提示词,确认后再花钱升分辨率。
  • 一体化生成与编辑:在统一模型里完成"从零生成"和"在已有素材上加工续写"两类任务。

Gemini Omni 1.1 Flash的核心优势

  • 10秒长上下文:模型可回溯分析前10秒画面(旧版仅1秒),续写时人物、光影、运镜保持连贯不跳变。
  • 4K成片级输出:直接输出1080p乃至4K分辨率,满足广告、预告片等专业制作标准,而非仅限预览。
  • 首尾帧精准控制:提供起始帧与结束帧即可自动生成平滑转场与镜头运动,结果高度可预期。
  • 参考视频一致性:引入最长3秒参考片段即可锁定角色形象与场景风格,有效解决AI视频"角色变脸"问题。
  • 360p低成本草稿:预览模式速度快60%、成本仅为三分之一,大幅压低创意迭代的试错开销。
  • 40秒长续写:基于已有视频每次10秒步进无缝扩展,单条叙事最长可达40秒,适合连续剧情创作。

Gemini Omni 1.1 Flash官网是什么

  • Página web del proyecto:https://blog.google/innovation-and-ai/technology/developers-tools/build-with-gemini-omni-1-1-flash/

Gemini Omni 1.1 Flash的操作步骤

  • Obtener acceso:登录Google AI Studio开通Gemini API账单,企业用户可经Vertex AI启用。
  • Seleccionar modelo:选定模型ID gemini-omni-1.1-flash,并根据需求选择生成新视频、续写旧片段或首尾帧过渡模式。
  • Preparar el material:备齐文本提示、首尾帧图片或最长3秒的参考视频,续写场景需传入旧片段的ID作为锚点。
  • 快速试错:先用360p分辨率低成本生成草稿,验证构图与动作是否符合预期。
  • 升级成片:确认草稿后切换720p/1080p正式生成,仅对定稿镜头启用4K档位控制成本。

Gemini Omni 1.1 Flash的适用人群

  • 短视频与自媒体创作者:用360p低成本预览快速试错,批量产出社媒短视频和动态封面。
  • 影视与广告从业者:借助4K输出、首尾帧控制和40秒续写,快速生成分镜、预告片和高质感商业短片。
  • 游戏与动画团队:通过场景扩展和参考视频保持角色一致性,高效制作Previz预演和动作分镜。
  • Operador de comercio electrónico:基于产品图指定首尾帧,生成360°旋转展示、细节特写等产品动态视频。
  • 教育与培训师:用参考视频锁定讲师或动画角色形象,批量生成课件动画和解释性视频。
  • Desarrollador de IA:通过Gemini API/Vertex AI将视频生成能力集成进自有应用和工作流。

Gemini Omni 1.1 Flash的常见问题

Q1:生成一条视频最长可以是多少秒?

A1:单次生成基础上,可通过场景续写每次以10秒为步长扩展,单条叙事累计最长可达40秒。


Q2:视频续写时需要提供什么?

A2:需传入已有视频片段及其 previous_interaction_id 作为续写锚点,模型会分析此前最多10秒的上下文保持连贯。


Q3:如何保证不同镜头中角色形象一致?

A3:可上传最长3秒的参考视频,模型提取人物长相、动作模式和场景风格并在新镜头中延续,结合首尾帧控制可进一步锁定画面。


Q4:可以免费用吗?

A4:无免费API层级,需要开通付费账单才能调用;建议先用360p草稿模式低成本验证创意。


Q5:生成的视频有水印吗?

A5:所有生成视频均带有SynthID隐形水印,用于AI内容标识与溯源。

© declaración de copyright

Artículos relacionados

Sin comentarios

Debe iniciar sesión para participar en los comentarios.
Acceder ahora
ninguno
Sin comentarios...