Google DeepMind 刚刚放出了 Gemini Omni 1.1 Fl…

Google DeepMind 刚刚放出了 Gemini Omni 1.1 Flash,这是他们最新的多模态视频生成和编辑模型。这次升级的核心亮点是场景续写能力的飞跃——从之前 Veo 的 1 秒上下文直接拉到 10 秒。 这意味着什么?你给它一段 10 秒的原始视频,它能基于这段内容向后续写,生成更长、连贯性更强的视频片段。之前用 AI 生成视频最头疼的就是「每次只能做一小段,拼起来风格断裂」,现在这个问题基本被解决了。 其他新功能也相当实用:4K 超分辨率、首末帧精确控制、快速 360p 草稿模式。特别是首末帧控制,对做产品演示视频或者创意短片的人来说,等于拿到了逐帧级别的导演权限。 从发布节奏来看,Google 正在把 Veo 系列的创意控制能力全面整合到 Gemini 生态里。视频生成不再是独立功能,而是变成多模态大模型的一个内生能力。这个方向一旦跑通,后续的想象空间会大很多。 对于做内容创作的朋友来说,最直接的影响是:以后做短视频的素材成本会继续下降,但对「创意」和「叙事能力」的要求反而更高了。工具门槛降低,审美门槛升高,这个趋势越来越明显。
20 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单