郭震 AI公众号:郭震AI

实时 AI 消息

Anthropic披露:Claude被用于武器研发、监控与网络攻击

Anthropic发布威胁情报报告,称其Claude模型被多个行为体用于武器研发、监控系统和网络攻击等活动,涉及与中国、俄罗斯相关的操作者。报告还提到五个可能支持生物武器研究的案例,以及马里一套可监控约2500万张SIM卡数据的系统,显示前沿模型被滥用的现实风险正在上升。

发布时间
Anthropic披露:Claude被用于武器研发、监控与网络攻击
图源: anthropic.com

Anthropic公布的一份威胁情报报告显示,其Claude模型被发现用于武器研发、监控行动和网络攻击等用途。据Impakter报道,报告点出了与多个国家相关的行为体,其中最敏感的部分集中在军事系统和生物研究两项上。

报告称,与中国相关的行为体使用Claude开发防空系统和反鱼雷系统;与俄罗斯相关的行为体则用它开发用于自主攻击无人机蜂群的软件。

在网络空间,报告提到讲中文的操作者使用Claude针对约50家机构发起行动,其中包括外国政府网络。Anthropic称,由AI驱动的工作流帮助这些操作者发现漏洞、开发利用代码并实施入侵,且整个过程只需有限的人工监督。

更值得关注的是生物领域。Anthropic表示识别出五个案例,涉及尝试用其模型进行可能支持生物武器研发的研究,而这类用途一旦成型,后果最难挽回。

报告还披露了AI辅助的监控用途,目标包括维吾尔人、异见人士和政治团体。在马里,Claude被用于搭建一套系统,可监控该国三家移动运营商旗下约2500万张SIM卡的相关数据。

这些案例说明的问题,不在于某一次滥用的规模,而在于门槛。当一个前沿模型可以同时被用于防空系统、无人机蜂群软件和漏洞开发时,AI开发商在模型分发之后阻止其被军事情报和犯罪用途改造,已经变成一项持续的对抗工作,而不是发一份使用政策就能解决的事。

对Anthropic来说,公开这些案例既是安全叙事的需要,也与监管压力相关——模型的滥用证据越具体,越容易推动各国把模型能力评估与使用限制写进规则。后续要看的是:报告披露的账号与用途如何处置、检测方法是否公开,以及其他厂商是否给出同样颗粒度的披露。

为什么重要

Anthropic把Claude被用于武器、监控和网络攻击的案例公开,等于承认前沿模型的滥用治理难以靠事前一纸禁令解决,这会推动监管与企业采购把滥用检测和用途限制纳入硬性要求。

微博邮件

AnthropicClaudeAI Safety
返回实时消息

附近消息

全部

09/14 13:06

微软将发布首份AI模型行为准则,纳德拉主张去中心化AI治理

微软宣布将发布公司首份AI模型行为准则,并把这份文件公开交给外界评议,被视为其在AI治理议题上的一次主动表态。微软CEO纳德拉强调,AI治理不应由少数实体掌控,而应让生态系统、各国和学术界广泛参与,呼应了业界推动去中心化治理的声音。

09/14 12:05

OpenAI 测试全新 ChatGPT 广告形态:点击后进入品牌对话,而不是跳转网站

Digiday 报道,OpenAI 已向部分客户推出一款面向 ChatGPT 应用的 AI 原生广告,广告主可在广告上挂载品牌 AI 智能体,用户点击“Chat to us”后不会跳转到品牌官网,而是直接进入 ChatGPT 内的品牌对话。Wayfair 正在试用,OpenAI 首席财务官 Sarah Friar 此前称现有广告只是“基础的起点”。

09/14 11:55

中国大模型周调用量连续二十周领跑,DeepSeek V4.1 Flash 上线三天升至第六

《每日经济新闻》基于 OpenRouter 最新数据测算,9 月 7 日至 13 日全球大模型总调用量达 127 万亿 Token,中国大模型以 61.17 万亿 Token 连续二十周位居全球首位。9 月 10 日发布的 DeepSeek V4.1 Flash 上线三天即升至第六,前五名中有四款是中国模型。

09/14 11:01

DeepSeek-V4.1-Flash 技术拆解:552B 总参数、8B 激活的 MoE 多模态模型

HackerNoon 对 DeepSeek-V4.1-Flash 的模型卡做了技术梳理:这是一款接受文本与图像输入的多模态混合专家模型,总参数 552B,单次推理只激活约 8B 参数,主打长上下文下的内存与推理效率。模型以 MIT 许可开放权重,支持 1M token 上下文与可调推理强度,但在部分推理基准上仍不及体量更大的 V4-Pro 系列。