Gemini Omni 1.1 Flash 今日发布

Google DeepMind 于 2026 年 8 月 27 日正式发布的视频生成与编辑模型

AI视频 部分免费

Gemini Omni 1.1 Flash 是 Google DeepMind 于 2026 年 8 月 27 日正式发布的视频生成与编辑模型,定位从「会生成」升级为「可控制、可直接投入专业生产」。这是 2026 年 5 月发布的初代 Gemini Omni 的首次重大生产级更新,原生支持文本、图像、音频、视频四种模态输入,输出带音频、24 帧/秒、单次 3 至 10 秒视频。

核心能力集中在控制与效率两端。场景延伸(Scene Extension)让模型可分析最多 10 秒前序画面(此前仅参考最后 1 秒),以 10 秒为单位累积延长,单条视频最长可达 40 秒,大幅提升画面一致性与叙事连贯性。首尾帧控制允许开发者通过指定起止帧,由模型生成过渡画面,适用于环绕运镜、推拉镜头与无缝循环素材。视频参考功能支持最多 3 段各 3 秒的参考片段,用于保持角色形象与画面上下文一致。效率方面,360p 草稿模式比标准 720p 生成速度快 60%,成本仅为三分之一,适合原型打样与分镜迭代,定稿后再生成 1080p 或 4K 高清成品。

第三方机构 Arena 盲测中,Gemini Omni 1.1 Flash 在文生视频类别排名第一,在图生视频类别仅次于开源 MiniMax H3 排名第二。SynthID 水印与生产过滤器默认启用,AI 生成内容可溯源。

定价按秒计费:360p 每秒 0.03 美元、720p 0.10 美元、1080p 0.15 美元、4K 0.30 美元。模型已在 Google AI Studio、Gemini Enterprise Agent Platform 上线,Google AI Plus、Pro、Ultra 订阅用户可在 Google Flow 与 Gemini App 中直接使用。Adobe 已将 Omni 1.1 集成进 Firefly 视频编辑工作流,Figma Weave、GMI Cloud、Runway 也已接入。旧版预览端点将于 2026 年 9 月 30 日弃用。

该模型的发布标志着 Google 在 AI 视频工程化方向的关键里程碑,通过场景延长、首尾帧控制等精细化创作能力,进一步拉低了短剧制作、广告创意、电商内容等场景的 AI 视频应用门槛。

团队信息

由 AI 猎手自动发现

评论与建议

0 条评论