谷歌否认Gemini用私人文档训练

时间:2026年8月8日 地点:美国山景城(Google 总部) 人物:Google 发言人;独立游戏开发者(Windows Report 报道) 事件详情: IT之家 8月8日援引科技媒体 Windows Report 报道,一名独立游戏开发者发现玩家通过 Google Gemini 搜索其工作室正在开发的游戏信息时,Gemini 回答中泄露了仅存在于私人 Google Docs 文档中的未公开角色"Vantage Tripod"。该角色此前从未上传到任何公开渠道,也未存储在游戏文件中。Google 回应称,公司不会扫描私人 Google Docs 训练 Gemini,只有用户主动发起请求时,Gemini 才会访问 Workspace 文件。如果有人将公开文档链接发布到互联网上,这些网页可能会被搜索引擎爬虫发现并建立索引。 背景: 事件再次把大模型"数据来源透明度"问题推上风口。随着 Gemini、ChatGPT、Claude 等大模型陆续接入 Workspace、Office、Google Docs 等办公套件,用户对个人/团队私有文档是否被用于模型训练高度敏感。Google 此次明确否认"扫描私人文档训练",但未解释 Gemini 是如何知道"Vantage Tripod"这一未公开信息,事件真实原因仍待进一步调查。该案例与 2023 年 Gemini 演示视频"造假"风波、2025 年 ChatGPT 涉嫌泄露三星机密事件同属"AI 隐私"治理争议的延续。 影响: - 影响1:Google 明确否认扫描私人 Google Docs 训练 Gemini,对 Workspace 数亿企业用户的合规焦虑是一次正面回应,但未解释信息泄露路径留下疑问,开发者社区仍会持续质疑。 - 影响2:事件再次证明"零点击/零授权"信息泄露在大模型时代已成新风险类型,AI 产品接入办公套件后即便不主动训练也可能通过索引、检索增强生成(RAG)等机制"间接"访问敏感信息。 - 影响3:未公开游戏角色提前曝光可能直接影响该工作室的发布计划与商业利益,凸显"独立创作者知识产权保护"在 AI 时代面临新挑战,类似事件将推动游戏、影视行业建立更严的内部 AI 使用规范。 - 影响4:Google 的官方回应将作为后续 AI 厂商处理类似指控的范本,AI 厂商需要在"训练数据声明""运行时数据访问说明"两方面给用户更清晰的解释。 总结: Gemini 疑似返回私人 Google Docs 信息是一起典型的"AI 隐私黑箱"事件。Google 否认扫描训练但未解释信息获取路径,开发者社区的疑虑难以完全消除。事件提示所有接入 AI 的办公套件厂商:仅声明"不训练"还不够,必须让用户能清楚追踪每一次 AI 访问的数据来源,这是 AI 时代数据治理的新基本要求。 参考来源: - https://www.ithome.com/0/987/371.htm - https://windowsreport.com/google-gemini-leaking-private-google-docs/ - https://support.google.com/gemini/answer/15745375 - https://workspace.google.com/solutions/ai/