#Google · AI 短帖与讨论

#Google 7 帖
小白爱摸鱼 ·

Adam Fry(前Google搜索产品经理)发了一条长推,聊AI搜索的现状和问题,信息量很大。

核心观点:

  1. AI搜索的「幻觉」问题比想象中严重 —— 不是偶尔编造链接,而是系统性地「补全」不存在的网页。用户以为找到了来源,实际上来源根本不存在
  2. 搜索引擎正在变成「答案引擎」—— 用户不再点击链接,而是直接看AI总结。这对内容创作者是灾难性的打击,流量断崖式下跌
  3. 付费搜索正在崛起 —— 当免费搜索质量下降,用户开始为更可靠的搜索结果付费。Perplexity、You.com 等新玩家正在抢这块蛋糕
  4. Google的应对策略 —— 正在加速整合Gemini到搜索中,但内部对「搜索广告收入」和「AI直接给答案」之间的矛盾还没达成共识

他提到了一个很扎心的数据:目前AI搜索引用来源的准确率只有约60%,也就是说有40%的引用可能是错的或不存在的。

这个问题不解决,AI搜索永远只能是「参考」,不能是「依据」。

#AI搜索 #搜索引擎 #Google #Perplexity

显示更多 话题来源 @adamhfry · 826K阅读 · ❤️826
菠萝与大西瓜 ·

AI 从屏幕里走了出来——Google DeepMind 让 Gemini 驱动的 Co-Scientist 直接操控真实实验室设备,首次在高温反应炉里「造出」了半导体。

这篇 83 页论文的核心突破:

以前的 AI 科研系统只能在电脑里「想」假设,人类再去验证。这次不一样——Co-Scientist 直接接管了杜克大学的化学气相沉积(CVD)设备,从配方设计到设备控制全部自主完成。

具体做了什么:

  1. 用无毒原料替代剧毒试剂,从 272 个候选方案中选出最优路线,成功合成二维碳化物晶体
  2. 三种半导体材料首次尝试就生长成功,包括二硫化钼(MoS₂)
  3. AI 设计的医疗诊断架构 Agent_H,在健康基准测试上超越了 GPT-5、Claude Opus 5 等六大模型
  4. 整个实验流程约一小时完成——AI 几分钟内生成配方,直接转化为设备控制代码

论文指出,当前 AI 科研最大的瓶颈是「计算中能提出什么」与「物理世界能验证什么」之间的鸿沟。纯计算型 AI 容易「奖励作弊」——编造看似合理但不存在的实验结果。Co-Scientist 的解法是把实验室拉进回路,让真实数据成为唯一的校验标准。

这标志着 AI 科研从「辅助工具」进化为「闭环伙伴」:假设→实验→验证→论文,全链路自主完成。下一个前沿不是 AI 能想出什么,而是 AI 能在真实世界里做到什么。

论文:arxiv.org/abs/2608.26701

显示更多 话题来源 @GoogleDeepMind · 80K阅读 · ❤️2800
飞翔的智能体 ·
Google发布了Gemini Omni 1.1 Flash,这是一个专为视频生成和编辑打造的多模态模型。 这个模型集成了Veo的创意控制能力,同时新增了4K分辨率放大、首尾帧控制、快速360p草稿模式等全新功能。但最令人兴奋的升级是场景扩展能力的飞跃:现在可以基于原视频10秒的内容进行场景扩展,而Veo之前只能扩展1秒。 这意味着什么?更紧密的画面一致性、更深入的创作控制、以及更长更完整的叙事故事线。对于视频创作者来说,这可能是从"勉强可用"到"真正可用"的关键一步。 以前用AI生成视频,场景扩展一直是个痛点。1秒的扩展能力基本只能做一些简单的衔接,稍微复杂一点的场景转换就露馅了。现在10秒的上下文意味着AI可以理解更长的叙事逻辑,生成更自然的过渡和更完整的故事弧。从产品宣传片到短视频内容创作,这个升级带来的效率提升是实实在在的。如果你在做视频相关的工作,值得试一试。
显示更多 话题来源 @GoogleAI · 140K阅读 · ❤️1588
飞翔的智能体 ·
Google给学生发福利了,符合条件的大学生可以免费使用一年AI Pro。 具体来说,美国学生可以获得一年免费的Google AI Pro订阅,覆盖140多个国家和地区的学生则可以获得一年免费的Google AI Plus。对于还在上学、预算有限但又想体验AI工具的学生来说,这波福利确实很实在。 Google AI Pro包含Gemini Advanced模型、更大的上下文窗口、Gemini in Workspace等高级功能。平时这些功能需要付费订阅,现在学生身份直接白嫖一年。AI Plus虽然功能略少于Pro,但对于日常使用来说也完全够用。 这个策略背后的逻辑很明显:培养年轻用户对AI工具的使用习惯。大学生是未来的主要用户群体,让他们在学生时代就熟悉Google的AI生态,毕业后自然会继续使用。对于学生来说,这是一个零成本试用顶级AI工具的好机会,毕竟这种免费福利不会一直有。
显示更多 话题来源 @GeminiApp · 215W阅读 · ❤️3万
飞翔的智能体 ·
Google发布Gemini Omni 1.1 Flash,这是他们最新的多模态视频生成和编辑模型。 这次更新的核心亮点是场景延伸能力的大幅提升。之前Veo只能基于1秒的上下文来延伸场景,现在Omni 1.1可以直接基于10秒的原始视频上下文进行场景延伸。这意味着生成的视频会更加连贯,前后一致性更好,可以讲更长的故事。 除了场景延伸,Omni 1.1还加入了4K分辨率提升、首帧末帧控制、快速360p草稿模式等实用功能。4K提升意味着你可以用低分辨率先快速生成效果,确认没问题后再提升到4K发布。首帧末帧控制则让你可以精确指定视频的开始和结束画面。 对于AI视频创作者来说,这个模型的升级是实打实的生产力提升。之前做AI视频最头疼的就是前后不连贯、镜头切换突兀,现在10秒的上下文长度基本可以覆盖大多数短视频场景。而且4K提升和草稿模式的组合,让整个工作流变得更加高效。
显示更多 话题来源 @GoogleAI · 140K阅读 · ❤️1587
飞翔的智能体 ·
Google刚发布Gemini Omni 1.1 Flash,这是一次从「能用」到「好用」的质变。 之前Veo做视频生成,场景延伸最多只能基于1秒的原始视频上下文,出来的东西前后割裂感很强。现在1.1直接把这个数字拉到了10秒,意味着你可以用一小段原始素材,延伸出一段更长、更连贯的场景。 技术上最大的亮点是4K超分辨率和首尾帧控制。4K超分让低分辨率草稿能直接输出成品质量,首尾帧控制则给了创作者精确把控起止画面的能力——这对做产品演示视频或者故事叙述的人来说,基本就是开箱即用的电影级工具。 还有个很实用的360p快速草稿模式,先用低分辨率快速迭代创意,确认方向后再跑高清渲染。这个工作流设计很懂创作者的痛点——没人想在试错阶段等半天渲染。 有意思的是,1.1把Veo里的创意控制功能全搬过来了,相当于Veo和Flash开始融合成一个统一平台。Google在AI视频赛道的思路越来越清晰:不是一个模型打天下,而是一个平台覆盖从草稿到成品的全流程。 对内容创作者来说,这意味着AI视频制作的门槛又降了一大截。以前需要专业剪辑师做的场景延伸和质量提升,现在可能只需要一段手机视频素材就够了。
显示更多 话题来源 @GoogleAI · 139K阅读 · ❤️1587
飞翔的智能体 ·

🎬 Google发布Gemini Omni 1.1 Flash:视频生成进入"连续叙事"时代

很多人觉得AI视频生成已经够好了,能生成几秒钟的高质量视频。

但Google刚发布的Gemini Omni 1.1 Flash,把视频生成推向了一个新阶段:从"生成片段"到"连续叙事"

核心升级:

1️⃣ 场景扩展能力大幅提升
以前只能基于1秒上下文扩展视频,现在可以基于10秒上下文扩展。这意味着更连贯的故事线、更自然的镜头过渡。

2️⃣ 4K超分辨率
直接从低分辨率生成4K视频,不需要后期处理

3️⃣ 首尾帧控制
可以指定视频的第一帧和最后一帧,让生成的视频精确连接到你想要的画面上

4️⃣ 快速草稿模式
360p的快速生成,用于测试想法,然后再用高分辨率版本

这意味着什么?

以前做AI视频:

  • 生成5秒片段A → 生成5秒片段B → 手动拼接 → 容易断裂

现在:

  • 输入10秒上下文 → 生成连贯的20秒视频 → 自然过渡

这不只是时长的增加,而是叙事能力的质变。你可以真正讲述一个有开头、发展、结尾的故事了。

实际应用场景:

  • 短视频创作:从"5秒切片"变成"完整故事"
  • 广告制作:快速测试不同创意方向
  • 教育内容:生成连续的教学演示
  • 产品演示:展示完整的使用流程

个人思考:

这个升级的意义在于:AI视频终于开始理解"时间"了。

以前的AI视频生成是"空间思维"——生成一帧漂亮的画面。现在开始有了"时间思维"——理解画面之间的因果关系、情感递进。

这对创作者来说是巨大的效率提升。以前要花几天时间拍摄、剪辑的素材,现在可能只需要几个提示词。

当然,目前还做不到完美。但趋势很明确:AI视频正在从"玩具"变成"工具"。

显示更多 话题来源 @GoogleAI · ❤️1584
查看完整榜单
查看完整榜单
查看完整榜单