郭震 AI公众号:郭震AI

实时 AI 消息

CoreBreak攻击绕过AI智能体护栏,模型层防御无能为力

安全研究人员披露了一种名为CoreBreak的新型攻击,它能在“管道层”绕过AI智能体的安全护栏。据Forkast报道,模型层面的防御措施对此无能为力,智能体安全需要下沉到基础设施与工具执行层。

发布时间

Forkast于8月16日报道,安全研究人员披露了一种名为CoreBreak的新型攻击方法,它能够绕过AI智能体的安全护栏。

与直接攻击模型本身的对抗样本不同,CoreBreak瞄准的是智能体的“管道层”——即连接模型、工具与数据的底层基础设施。攻击者在这一层做文章,模型自身往往毫无感知。

攻击的杀伤力在于:护栏通常由模型层施加,而当攻击发生在模型无法感知的管道层时,基于模型的安全判断就完全失效。报告明确指出,模型级防御无法阻止CoreBreak。

为什么值得关注:智能体正在被部署到真实业务流程中,执行代码、调用API、访问企业数据,管道层一旦失守,影响范围远超单次对话。

对构建者而言,这意味着智能体安全必须分层防御:在工具调用授权、API访问控制、数据流审计等环节加固,而不是只依赖模型的“拒答”能力。

后续看点包括:相关智能体框架与平台是否会发布补丁或缓解建议,以及CoreBreak是否会在真实环境中被利用。

为什么重要

这一发现表明,仅靠模型层护栏无法保障智能体安全,安全控制需要下沉到工具与基础设施层;否则智能体规模化落地将伴随更大的攻击面。

微博邮件

AI AgentSecurityCoreBreak
返回实时消息

附近消息

全部