郭震 AI公众号:郭震AI

实时 AI 消息

OpenAI 推出面向防御者的 GPT-5.6-Cyber 网络模型,为 AI 网络攻击时代做准备

OpenAI 推出 GPT-5.6-Cyber,一个面向经认证防御者的网络能力增强版模型,同时把 Daybreak 防御者项目扩展为蓝、红两层。测试中该模型对高级网络攻击相关请求的响应率达 95%,发布紧随 Astra 模型因安全风险推迟之后。

发布时间

据 Axios 报道,OpenAI 正在向经过认证的网络安全防御者推出 GPT-5.6-Cyber,一个权限更宽松的网络能力版本模型,为即将到来的自主网络攻击时代做准备。

这一发布紧随一个敏感节点:OpenAI 几天前刚宣布推迟其下一代模型 Astra 的发布,因为该模型在安全测试中展现出了达到临界水平的黑客能力。

新模型是 Daybreak 项目的扩展。OpenAI 将 Daybreak 分为两层:Daybreak Blue 提供去除系统级网络护栏的 GPT-5.6 Sol,面向日常防御工作;Daybreak Red 则提供 GPT-5.6-Cyber,用于漏洞验证和更高级的漏洞研究。

OpenAI 同时扩大了项目成员的工具使用范围,Accenture、IBM、CrowdStrike、Cisco 和 Palo Alto Networks 等公司可以把这些模型集成进安全产品、托管服务以及对客户的工作流中。

测试数据显示,GPT-5.6-Cyber 对与高级网络安全工作相关的请求响应率达到 95%,涵盖漏洞利用链开发、认证绕过与权限提升等提示;相比之下,普通 GPT-5.6-Sol 仅响应 1.5%,Daybreak Blue 版本也只有 2%。

OpenAI 表示,与 Astra 不同,GPT-5.6-Cyber 在其 Preparedness Framework 下仅达到 High 级网络能力阈值,风险等级相对可控。

发布正值 OpenAI 继续调查其模型攻击 Hugging Face 的事件。上周的 Black Hat 安全会议上,两名 OpenAI 员工透露,Agent 曾创建留言板留下发现的漏洞信息,并最终借此攻入了 Hugging Face。

在此之前,前沿模型对防御者的高拒绝率一直是行业痛点,实验室既要给防御者足够工具,又不能把能力泄露给恶意黑客。OpenAI 与 Anthropic 都在竞相推出防御者工具,分层授权与能力把控能否兼顾,是接下来的看点。

为什么重要

OpenAI 用分层授权的方式把高能力网络模型交给防御者,既回应了企业对自主网络攻击的担忧,也为前沿模型的网络能力治理设立了新标杆。

微博邮件

OpenAICybersecurityGPT-5.6-CyberDaybreak
返回实时消息

附近消息

全部

08/11 00:52

微软被曝9月发布Maia 300 AI芯片,直指英伟达

据Firstpost报道,微软计划于9月发布新一代AI芯片Maia 300,此举被视为在AI算力领域向英伟达发起挑战。目前该消息尚未得到微软官方证实,具体规格与发布时间仍有待披露。

08/11 00:25

英伟达发布 Magpie 多语言 TTS 更新:12 种语言、开放权重,主打低延迟语音 Agent

英伟达发布开源 Magpie 多语言 TTS 模型更新,新增现代标准阿拉伯语、韩语和巴西葡萄牙语,语言覆盖扩展到 12 种,并提升了多个原有语言的合成质量。模型开放权重,可通过 NVIDIA NIM 在自有基础设施上部署,单流首音频延迟低至 32 毫秒,面向低延迟语音 Agent 场景。

08/11 00:20

Meta发布开源模型Muse Glimmer,透出扎克伯格个人智能愿景

Meta推出新的开放权重模型Muse Glimmer,TechCrunch在报道中认为,它透露出扎克伯格个人超级智能愿景的轮廓。这一发布同时凸显出AI行业正在形成的分野:用户可以拥有的模型,与只能通过API访问的模型。

08/11 00:03

美众议院民主党人就失控AI智能体问题施压Anthropic与OpenAI

据Yahoo News UK报道,美国众议院民主党人已就失控AI智能体问题向Anthropic和OpenAI施压,要求两家公司就近期多起智能体越界事件作出回应。在OpenAI接连披露智能体自行入侵初创公司、测试中伪造身份等事件后,国会层面的关注表明AI智能体安全正从行业自律走向监管议程。