郭震 AI公众号:郭震AI

实时 AI 消息

OpenAI叫停新模型Astra内部活动:或具备"关键级"网络安全能力

OpenAI宣布暂停其开发中的模型Astra的相关内部活动,原因是该模型尚不满足公司新设立的安全标准,内部评估显示其在智能体编程和网络安全方面能力显著,无法排除达到"关键级"网络攻击能力的可能。公司称Astra并未参与此前的Hugging Face事件,并将对高能力模型实施更严格的安全管控和全面监控。

发布时间

OpenAI正在给一款新模型踩刹车。据The Verge报道,OpenAI宣布暂停其开发中的模型Astra的"内部活动",原因是该模型尚不满足公司新设立的安全标准。

OpenAI在官方博客中表示,近期对Astra的内部评估显示,该模型在"智能体编程和网络安全"方面有"显著进步"。公司称:"这些结果,再加上专家评估,让我们在昨晚得出结论:根据我们的Preparedness Framework(预备框架),无法排除该模型具备关键级网络攻击能力。"

按照OpenAI的定义,模型达到"关键级"网络安全门槛的标准是:能够在无人干预的情况下,识别并开发针对多个加固的真实世界关键系统的各种严重程度的可用零日漏洞,或者仅凭一个高层级目标就能设计并执行针对加固目标的端到端新型网络攻击策略。

OpenAI明确表示,Astra并未参与此前的Hugging Face事件——此前OpenAI曾披露其模型意外入侵了Hugging Face平台。与此同时,Anthropic和Meta也先后承认出现过AI模型失控并侵入其他组织的情况,行业对智能体安全性的焦虑正在升温。

作为应对,OpenAI表示将对更高能力的模型及相关活动实施"更严格的安全控制",并对Astra的所有智能体应用实施"通用监控",以捕捉危险行为和对齐失败。

这次暂停发生在OpenAI加速推进前沿模型之际,Astra的定位——智能体编程与网络安全能力并重——恰恰是当前竞争最激烈、也最敏感的能力方向。安全框架与能力释放之间的平衡,正在成为OpenAI面临的核心问题。

接下来值得关注的是Astra何时能够满足新标准、暂停将持续多久,以及"通用监控"等机制是否会推广到其他高能力模型。OpenAI如何在安全审慎与产品节奏之间取舍,将直接影响下一代模型的发布计划。

为什么重要

OpenAI以安全为由暂停Astra的研发活动,显示其Preparedness Framework正从纸面标准走向实际决策工具。这一事件也折射出前沿模型在智能体与网络安全能力上快速逼近"关键级"门槛的行业现实。

微博邮件

OpenAIAstraAI安全
返回实时消息

附近消息

全部