时间:2026年9月10日
地点:美国加州山景城
人物:Logan Kilpatrick(谷歌DeepMind工程师)、Ethan Mollick(宾夕法尼亚大学AI研究员)、Demis Hassabis(谷歌DeepMind创始人)
事件详情:
9月10日,谷歌DeepMind工程师Logan Kilpatrick在X平台公开反驳AI研究员Ethan Mollick"谷歌不再拥有前沿模型"的质疑。Kilpatrick明确表示,Gemini 3.8 Cyber在多项网络安全基准测试和实际应用中已超过Anthropic Mythos模型,并已在Chrome、Wiz、Cloud等团队广泛使用。Google DeepMind于9月2日发布Gemini 3.8 Flash和Gemini 3.8 Flash Cyber两款模型,后者是面向网络安全防御人员推出的受限访问版本,专注于漏洞发现与自动修补。
背景:
9月9日,Ethan Mollick在X发文称"谷歌不再拥有前沿模型"意味着谷歌将错失数学突破与网络安全两大领域。Gemini 3.8 Flash和Flash Cyber是谷歌六周内发布的第三款Flash模型,前者主打智能体和编程任务,后者专攻网络安全。在CWE-Bench外部基准上,Gemini 3.8 Flash Cyber取得47.2% pass@1的成绩,接近业界领先模型;在CyberGym基准上达到86.2%,展现出前沿级漏洞发现能力;在Google内部基准上,覆盖20种语言复杂代码库的漏洞修补成功率超过70%。
影响:
此次反驳凸显谷歌在网络安全AI赛道的实际竞争力,Gemini 3.8 Flash Cyber作为受限访问模型,正在成为网络安全防御人员的重要工具。该模型或将进一步巩固Google DeepMind在前沿网络安全模型领域的领先地位,同时意味着Anthropic Mythos在网络安全基准上的领先优势被进一步收窄。
总结:
谷歌DeepMind工程师以实测数据公开反驳外界质疑,强调Gemini 3.8 Cyber在网络安全基准上的领先表现。该模型专为防御人员设计,采用受限访问机制并聚焦漏洞发现与自动修补,代表网络安全AI模型的新前沿。
参考来源:
https://www.ithome.com/1/000/954.htm
https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/
https://deepmind.google/models/gemini/cyber/
https://venturebeat.com/security/googles-gemini-3-8-flash-is-built-for-agents-while-its-cyber-twin-hunts-vulnerabilities
https://www.testingcatalog.com/google-releases-gemini-3-8-flash-and-flash-cyber/
https://qz.com/google-gemini-38-flash-cyber-ai-model-090326
https://medium.com/infosec-writes-up/gemini-3-8-flash-cyber-review-15040451368a
https://x.com/emollick/status/2097797992904282134









