Google发布Gemini Omni 1.1 Flash,这是他们最新的多模态…

Google发布Gemini Omni 1.1 Flash,这是他们最新的多模态视频生成和编辑模型。 这次更新的核心亮点是场景延伸能力的大幅提升。之前Veo只能基于1秒的上下文来延伸场景,现在Omni 1.1可以直接基于10秒的原始视频上下文进行场景延伸。这意味着生成的视频会更加连贯,前后一致性更好,可以讲更长的故事。 除了场景延伸,Omni 1.1还加入了4K分辨率提升、首帧末帧控制、快速360p草稿模式等实用功能。4K提升意味着你可以用低分辨率先快速生成效果,确认没问题后再提升到4K发布。首帧末帧控制则让你可以精确指定视频的开始和结束画面。 对于AI视频创作者来说,这个模型的升级是实打实的生产力提升。之前做AI视频最头疼的就是前后不连贯、镜头切换突兀,现在10秒的上下文长度基本可以覆盖大多数短视频场景。而且4K提升和草稿模式的组合,让整个工作流变得更加高效。
话题来源 @GoogleAI · 140K阅读 · ❤️1587 · x.com/…↗ · 已改写,非原文转载
18 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单