OpenAI:Astra或达关键网络安全阈值

时间:2026年8月7日 地点:美国旧金山(OpenAI 总部) 人物:OpenAI 安全与策略团队;OpenAI 内部 Astra 模型评估团队 事件详情: OpenAI 于 8 月 7 日发布官方声明,承认其即将推出的下一代模型 Astra 在内部评估中可能达到"关键网络安全阈值"(Critical cybersecurity capability)。根据 OpenAI 2023 年 12 月发布的 Preparedness Framework 框架,模型在无需人工介入的前提下识别并开发出大量真实世界关键系统的功能性零日漏洞利用,或能针对加固目标设计并执行端到端新型网络攻击策略,即视为达到该阈值。Astra 团队已暂停未达强化安全控制要求的内部活动,加强模型权重保护与加密,并在隔离测试环境中部署通用监控以检测 Chain of Thought 中的高风险动作。OpenAI 同时澄清,Astra 并未参与近期利用 Hugging Face 的漏洞事件。先前评估中 GPT-5.6-Sol 也曾被评估达到 High 阈值,未达 Critical。 背景: OpenAI 的 Preparedness Framework 自 2023 年 12 月发布以来持续承担"早期预警 + 监管触发器"角色。2025 年 6 月,OpenAI 在接近生物能力 High 阈值时曾发布类似声明并强化外部专家测试、安全控制和部署规范,本次是 OpenAI 第二次因模型能力逼近关键阈值而采取公开响应。当下国际社会对前沿模型双重用途风险高度关注——既能增强防御,也能加速攻击。Astra 事件意味着前沿模型在自主代理能力上的进展正进入实战级门槛。xAI 此前也曾预告训练 6 万亿与 10 万亿参数的 Grok 变体,Elon Musk 透露基于 Colossus 2 集群训练,前沿模型训练规模持续扩张。 影响: - OpenAI 暂停 Astra 内部非必要活动并强化安全控制,意味着该模型短期内不会公开发布,前沿模型安全治理开始从"事后响应"转向"主动拦截"。 - Preparedness Framework 在生物、网络安全、AI 自改进等领域已两次被触发,正在成为业界事实标准,可能被欧盟 AI 法案、美国行政命令等监管文本引用。 - 模型权重保护、加密、隔离测试环境等"高能力模型"的合规要求被 OpenAI 实操化,倒逼 Anthropic、Google DeepSeek(应为 DeepMind)等其他前沿实验室对标。 - Hugging Face 漏洞利用事件与 Astra 声明同日发生,凸显开源 AI 平台与闭源前沿模型在供应链安全上的耦合风险,开源平台将面临更强的漏洞披露压力。 总结: OpenAI 此次公开声明,是其 Preparedness Framework 自 2025 年生物阈值后的第二次实质性触发。Astra 被评估可能达到"关键网络安全阈值",OpenAI 选择"先暂停 + 后公开"的安全治理路径,与 2025 年 6 月生物阈值事件一脉相承,但首次涉及网络安全这一更具双重用途风险的领域。Astra 暂停意味着前沿模型发布节奏正式让位于安全治理,这一转向也可能被欧盟 AI 法案、美国 AI 行政命令等监管文本在下一轮修订中吸收。 参考来源: - https://openai.com/index/responding-next-frontier-critical-cyber-capabilities - https://news.sina.cn/gj/2026-08-08/detail-inimpnfx3009114.d.html - https://finance.eastmoney.com/a/202608083835578486.html - https://news.fx678.com/202608080039251123.shtml - http://m.toutiao.com/group/7671334955469636111/?upstream_biz=VolcEngine - https://www.panewslab.com/zh/articles/019fdd1d-153b-7416-8771-f49c512b7608 - http://m.toutiao.com/group/7671334915376333363/?upstream_biz=VolcEngine