郭震 AI公众号:郭震AI

实时 AI 消息

OpenAI Astra成为旗下首款具备“Critical”级黑客能力的AI模型

据Decrypt报道,OpenAI旗下模型Astra成为该公司首款具备“Critical”级黑客能力的AI模型,评级指向其在漏洞利用与攻防相关任务上的高阶能力表现。这一进展既展示了模型在安全场景中的实用价值,也让高等级攻击能力如何被约束的问题变得更加紧迫。

发布时间

据Decrypt报道,OpenAI旗下模型Astra已成为该公司首款具备“Critical”级黑客能力的AI模型。这一评级意味着OpenAI自有模型在漏洞利用与攻防相关任务上的能力刻度出现了明显跃升。

报道并未披露Astra具体通过了哪些测试,但“Critical”评级本身指向该模型在漏洞利用、渗透与攻防相关场景中的高阶表现。

对安全行业来说,这类能力是典型的双刃剑:具备高等级攻防能力的模型,可以用于自动化渗透测试、漏洞挖掘与红队演练,从而把安全专家从重复劳动中解放出来;但同样的能力一旦被滥用,也可能降低真实网络攻击的实施门槛。

更重要的是,这一评级把模型安全问题从“拒绝有害请求”推向了“模型本身具备攻击能力”的新阶段。对OpenAI而言,如何在不削弱Astra实用价值的前提下控制其安全风险,将是一道比单纯对齐训练更复杂的考题。

接下来值得关注的是,OpenAI会为Astra设置怎样的使用边界,是否会向安全研究社区开放相关能力,以及监管机构将如何看待具备高等级攻击能力的前沿模型。

为什么重要

Astra拿到的高等级攻击能力评级,把AI安全讨论从内容拒答推进到模型原生攻击能力的治理层面,OpenAI的防护设计与监管态度将成为后续焦点。

微博邮件

OpenAIAstraCybersecurity
返回实时消息

附近消息

全部