实时 AI 消息
报告:中国 AI 开发者仅为 3.6% 的模型发布公开安全测试
一份报告发现,中国 AI 开发者在其发布的模型中,只有约 3.6% 同时公开了安全测试结果。这一数字凸显出模型发布环节的安全透明度仍然偏低。
一份最新报告发现,中国 AI 开发者在发布模型时公开安全测试的比例仅为 3.6%。也就是说,在绝大多数模型上线时,外界很难从公开材料中看到相应的安全评估结果。
安全测试通常用于考察模型在被滥用、产生有害内容或出现其他风险时的表现。是否公开这些结果,直接关系到开发者之外的人——包括研究者、监管者和普通用户——能否独立了解模型的行为边界。
3.6% 这个比例之所以引发关注,是因为模型能力不断提升的同时,滥用与失控的风险也在上升。如果发布环节缺少透明的安全说明,外部监督就很难真正建立起来。
需要说明的是,公开测试结果并不等同于模型不安全,也不代表没有进行内部测试;它反映的是对外披露的程度。报告触及的核心,是透明度而非绝对安全性。
对行业而言,这一发现可能推动更多关于模型发布规范的讨论。随着各方对 AI 安全提出更高要求,发布时附带安全信息或将从加分项变成基本要求。
后续值得关注的是,这一比例会否随时间变化,以及开发者与监管方是否会就安全测试的披露标准形成更明确的共识。
为什么重要
该发现把模型发布时的安全透明度问题推到台前,可能促使开发者和监管方就披露标准展开更多讨论。
附近消息
全部10/09 21:04
AIFA 为 aifa.one 推出创作者计划并升级 AI 智能体
AIFA 宣布为 aifa.one 平台推出创作者计划,并同步升级其 AI 智能体能力。这是该公司在平台功能上的一次公开更新。
10/09 21:15
Qwen 上线 Qwen-Image-2.1-Turbo,文生图家族新增加速版本
Qwen 官方 Hugging Face 仓库上线了 Qwen-Image-2.1-Turbo,模型卡显示它是基于 Qwen/Qwen-Image-2.1 的微调版本,流水线为文生图。该模型通过 diffusers 库发布、权重为 safetensors 格式,上线初期获得 55 个点赞。
10/09 22:04
Amperity推出AI代理Pér:掌握完整客户视图并可直接行动
客户数据平台公司Amperity发布了名为Pér的AI代理,宣称它能够掌握每一位客户的完整画像,并基于这一视图直接采取行动。这款产品把客户数据的整合能力与代理式执行结合在一起,瞄准营销与客户运营场景。
10/09 22:52
Meta 与 Sierra 联合推出个人智能体协议
Meta 与 Sierra 正在联合 Shopify、Stripe、Walmart 等企业,共同开发名为个人智能体协议的开放标准,用来规范个人 AI 智能体如何代表消费者与企业交互。协议把访问权限的决定权交给消费者、把可执行范围的设定权交给企业,并计划发布 v0.1 版规范以及支付相关扩展。