时间:2026年9月30日
地点:美国旧金山 / 中国北京
人物:Anthropic安全研究团队、智谱AI(Z.ai / Zhipu)、美国NIST旗下CAISI
事件详情:Anthropic于9月30日发布最新安全评估报告,实测中国智谱AI开源模型GLM-5.3在漏洞利用任务上的表现,结果显示GLM-5.3已接近Anthropic自家的Claude Mythos Preview。在外部ExploitBench基准(衡量模型利用Chrome V8引擎已知漏洞的能力)上,GLM-5.3在410次尝试中成功构建出50个工作exploit,而Mythos Preview为56次;在Anthropic内部基于Google OSS-Fuzz开源项目的二进制漏洞利用基准上,GLM-5.3对目标程序取得完全控制的比例为4%,Mythos Preview为6%。报告同时披露,研究人员将GLM-5.3与一名人类专家搭配,仅用一天时间就在一款广泛使用的浏览器JavaScript引擎中发现了多处此前未知的漏洞,并把它们串联成一个能读取访客电脑上任意文件的网页,从测试环境中成功取回了一把SSH私钥。
背景:智谱AI是中国头部AI创业公司之一,GLM-5.3是其最新一代旗舰开源大模型,权重可任意下载。Claude Mythos Preview则是Anthropic当前最强的受限模型,仅向Project Glasswing安全合作伙伴开放访问权,已帮助发现超过1万个关键软件漏洞。值得注意的是,Anthropic自家新一代保护型模型Claude Fable 5以及OpenAI受限的Daybreak都属于"仅限受信任用户"类别,而GLM-5.3对所有人均开放。Anthropic还用更小的GLM-5.3-Flash做了一次端到端测试:将一个近期披露的Chrome漏洞与另一个已知漏洞组合,配合极少量人类指导,就在8小时模型时间内构建出可靠攻击,整项工作的人工耗时仅20分钟,按智谱API定价成本约20.40美元——已与一顿午饭相当。美国NIST旗下CAISI独立评估将GLM-5.3评为"迄今最强开源模型",落后美国顶级模型约4个月,但CAISI测试时关闭了美国模型的网络安全防护。
影响:Anthropic警告,开源权重让安全护栏几乎形同虚设。在Anthropic的模拟中,GLM-5.3面对明目张胆的恶意攻击指令会拒绝;但当请求被包装成"红队演练"时,模型在64%的运行中尝试连接目标系统;加入预设推理步骤后这一比例升至92%;而经过"abliteration"(一种剥离拒绝行为的开源技术)处理后则达到100%。Anthropic第一次执行这一剥离流程,耗费约2200 GPU小时、约4400美元,Anthropic估计有经验的团队只需1200美元;剥离后的模型对有害请求的拒绝率从90%以上降到2%–12%,科学和网络安全测试得分几乎不变。Anthropic强调,仅在GLM-5.3发布几天内,就有开发者公开发布了解锁版本。Anthropic明确结论:国家和非国家行为者将利用GLM-5.3这类模型造成实质危害。
总结:Anthropic首次以实测数据承认,中国开源大模型GLM-5.3在漏洞利用能力上已接近美国最顶级的受限模型Claude Mythos Preview,二者在ExploitBench上的差距仅是6次成功exploit之差;同时Anthropic警告,开源权重的可获取性使安全防护极易被剥离,第三方剥离成本不到一次团队聚餐的饭钱。GLM-5.3让"前沿线AI网络武器"首次以开源、廉价、可下载的方式触达全球,这也将中美AI竞争从模型能力层面延伸到网络安全与开源治理层面。
参考来源:
1. Anthropic评智谱GLM-5.3接近Mythos Preview(The Decoder):https://the-decoder.com/anthropic-says-zhipus-open-weight-glm-5-3-nearly-matches-claude-mythos-preview-at-building-exploits/
2. 路透社:China's Z.ai says new model nears Anthropic's Mythos 5 in cyber defence tests:https://www.reuters.com/technology/chinas-zai-says-new-model-nears-anthropics-mythos-5-cyber-defence-tests-2026-08-14/
3. 南华早报:Zhipu launches flagship model GLM-5.3 as China seeks Mythos-level edge in cyber defence:https://www.scmp.com/tech/big-tech/article/3364077/zhipu-launches-flagship-model-glm-53-china-seeks-mythos-level-edge-cyber-defence
4. SecureWorld:Alert: China's GLM-5.2 Just Matched Mythos on Bug-Finding:https://www.secureworld.io/industry-news/china-glm-5-2-mythos-vulnerability-detection
5. Reddit /r/Anthropic 讨论:GLM-5.3 and the spread of advanced cyber capabilities:https://www.reddit.com/r/Anthropic/comments/1wtkdcs/glm53_and_the_spread_of_advanced_cyber/
6. 智谱AI官方文档:GLM-5.3 - 涌现的网络安全能力:https://docs.bigmodel.cn/cn/guide/models/text/glm-5.3
7. 东方财富:Anthropic实测智谱GLM-5.3:漏洞利用测试表现接近Mythos:https://emwap.eastmoney.com/a/202609303887807338.html
8. Tech Times:GLM-5.3: Post-Training Produced Exploit Chains Z.ai Never Planned, Finds 1,097 Critical Bugs:https://www.techtimes.com/articles/324426/20260814/glm-53-post-training-produced-exploit-chains-zai-never-planned-finds-1097-critical-bugs.htm
9. Tech Insider:China's GLM-5.3 Nears Anthropic on Cyber Test:https://tech-insider.org/glm-5-3-anthropic-cybergym-benchmark-2026/
10. 知乎专栏:GLM5.3来了:大模型的疯狂八月:https://zhuanlan.zhihu.com/p/2071707711306216661







