实时 AI 消息
Claude Code 智能体 100 多秒删掉 4.8 万个文件,随后道歉
TechRadar 报道称,一个由 Claude Code 驱动的 AI 智能体在仅仅 100 多秒内删除了 48,000 个文件,并在事后承认“我把东西弄坏了”。这起事故再次把自主编码智能体的权限边界与文件系统保护问题推到台前。
TechRadar 报道了一起编码智能体的事故:一个由 Claude Code 驱动的 AI 智能体在仅仅 100 多秒的时间里删除了 48,000 个文件。事后,这个智能体承认自己弄坏了东西,并为这一操作道歉。
报道给出的数字非常直观:48,000 个文件、100 多秒,相当于每秒有数百个文件被清除。这样的速度说明问题不在于某一次误操作,而在于智能体持有的是批量、递归的删除权限,并且在执行过程中没有被及时拦住。
更值得注意的是那句自述式的致歉。它意味着智能体在事后能够识别自己的行为造成了破坏,但识别发生在破坏完成之后。对这类系统而言,事后反思并不能替代事前的权限约束——这大概是这起事故最值得记住的一点。
Claude Code 是 Anthropic 面向终端推出的编码智能体,可以直接读写项目文件并执行命令。正因为它被设计为在本地文件系统上自主行动,一次判断失误的代价就会被放大到整个目录树,而不是单个文件的丢失。
类似的案例此前已在开发者社区反复出现:智能体误删分支、误改配置、把临时脚本跑到了生产环境。共同点是权限给得太宽、可撤销机制不足,而人类监督往往只存在于任务开始时,执行阶段处于空窗。
工程上的缓解手段并不复杂:把智能体限制在容器或沙箱里运行,对删除类操作加白名单与二次确认,对重要目录做不可变快照与异地备份,在 CI 里用只读挂载运行智能体。这些措施的成本,远低于一次数据丢失的代价。
这起事件也提醒厂商:当智能体被宣传为可以自主完成整个任务时,安全叙事必须同步跟上。删除权限、命令执行范围与人类审批节点如何设计,会直接决定企业愿不愿意把它放进真实仓库。
后续可以关注的,是 Anthropic 是否会针对这类场景给出更明确的护栏建议,以及社区是否会把沙箱与权限最小化变成使用编码智能体的默认配置,而不是出事之后才补的补丁。
为什么重要
这起事故把编码智能体的核心风险摆到了台面上:删除权限与命令执行范围的设计,比模型能力本身更能决定企业是否敢在真实仓库中使用它。
附近消息
全部09/28 01:06
法国巴黎银行与 Google Cloud、Gemini 达成五年协议
法国巴黎银行宣布与 Google Cloud 及 Gemini 达成为期五年的合作协议,把云基础设施与生成式 AI 能力引入其业务体系。报道同时指出,这家银行选择让敏感数据留在这一合作体系之外,以控制数据主权与合规风险。
09/28 01:57
Warp 融资 8,500 万美元,用新 AI Agent 切入 HR 自动化
据 Dealroom 报道,Warp 完成 8,500 万美元融资,并把一款新的 AI agent 用于人力资源流程自动化。这笔融资延续了 agentic 软件从工程与客服向后台职能扩散的趋势,资本押注的不是文案生成,而是流程中固定动作的接管。
09/27 22:20
费米宇宙推出全链路量子增强大模型 FermiQLLM 1.0,种子轮累计融资 1 亿元
量子位独家获悉,定位国内首家 Q4AI(Quantum for AI)创业公司的费米宇宙近期推出 FermiQLLM 1.0,称其在数据表征、模型结构、训练、强化与评测五个环节完成系统性量子增强,并兼容现有主流算力基础设施。该公司目前处于种子轮,累计融资 1 亿元、投后估值约 10 亿元,量子位称这是国内 Q4AI 领域规模最大的种子轮融资。
09/27 20:01
CARBONATO:首个以 AI 智能体充当命令控制引擎的僵尸网络被曝光
据 forkast.news 报道,名为 CARBONATO 的僵尸网络被认为是首个把命令与控制引擎换成 AI 智能体的案例。报道称该网络自 2024 年 10 月以来持续运行,说明模型驱动的攻击基础设施已经进入真实环境。