OpenAI发布网络安全专用模型Astra,首次达到内部安全框架Critical最高风险等级

OpenAI发布了Astra,一个专门用于网络安全的AI模型,直接达到了他们内部安全框架里的"关键"级别。 这意味着什么?Astra不是普通的聊天AI,它是一个能在网络安全领域自主发现漏洞、分析威胁的模型。OpenAI说这是第一个达到Critical阈值的模型——在他们的准备度框架里,这已经是最高风险等级了。 为了安全发布,OpenAI做了大量评估和防护升级。他们公开了评估方法,展示了怎么在能力提升的同时把安全护栏也拉上去。 这件事的背景是:AI在网络安全领域的攻防能力正在快速逼近人类专家水平。Astra能自己写代码跑实验、分析复杂威胁,甚至把一篇论文变成研究员一周的工作量。当AI在攻击端变强的时候,防守端也必须跟上。 OpenAI选择在发布前先公开安全评估,而不是先发再说,这个做法值得关注。在AI安全越来越被重视的今天,这种透明度可能是行业需要的标准动作。
话题来源 @OpenAI 123K阅读 ❤️2463 x.com/…↗ 已改写,非原文转载
这条帖答的是
  • OpenAI的Astra网络安全模型达到Critical级别是什么意思 #AI
  • OpenAI Astra模型能自主发现漏洞和威胁吗 #AI
  • OpenAI发布Astra前公开安全评估的做法有什么意义 #AI
15 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单