实时 AI 消息
报道称OpenAI与Anthropic曾推动相互验证AI模型的协议
据韩国媒体报道,OpenAI与Anthropic曾推动一项协议,核心内容是相互验证彼此的AI模型。两家最直接的前沿模型竞争者尝试把对方的模型纳入自己的核验流程,反映出行业对安全声明可信度的共同焦虑。
据韩国媒体SBS报道,OpenAI与Anthropic曾推动一项协议,核心内容是相互验证彼此的AI模型。报道给出的信息集中在事件本身:两个最前沿的模型开发者,尝试把对方的系统纳入自己的核验流程。
相互验证之所以值得注意,是因为当前前沿模型的评估大多由开发者自己完成,或者委托给由开发者付费的机构。外部很难独立判断一个模型在安全、鲁棒性等维度上的真实表现,模型卡与系统卡里的说法,长期依赖企业自证。
如果由竞争对手来交叉核验,情况会不同。OpenAI与Anthropic在通用助手与企业市场上是直接对手,让对手进入自己的评估环节,验证的独立性会明显高于自评,但同时也会牵出商业机密、模型暴露与竞争顾虑。
这一动向出现在行业对自证安全的信任赤字加深的背景下。模型能力的迭代速度远快于评估工具、审计标准与第三方机构的建设;当监管开始要求企业披露安全措施时,缺乏可验证的证据链,是各家共同面对的短板。
从治理角度看,竞争对手之间的互验机制,可能比单方面的安全承诺更有约束力:承诺可以修改或撤回,而一旦形成固定的互验流程,退出本身就会被视为一种信号。
后续要看三件事:这项协议是否真正落地,覆盖哪些模型与哪些指标,以及是否有第三方标准组织或监管机构被引入。对行业而言,它提出的根本问题是:当模型开发者同时是安全声明的主要来源时,由谁来验证验证者。
即便这项安排最终没有成型,它被报道本身也说明,前沿实验室已经开始把彼此的模型视为需要外部核验的对象,而不只是竞争的对手。
为什么重要
由竞争对手承担的交叉验证,可能成为自我评估之外的一条补充路径;如果这类机制落地,模型安全声明的可验证性将成为行业竞争与监管合规的新维度。
附近消息
全部09/22 10:03
Light Origins 开源 Light-O1-Preview:6B 全身动作模型把人类视频先验搬进机器人
Light Origins 以 Apache 2.0 许可开源了约 60 亿参数的全身动作模型 Light-O1-Preview,权重发布在 Hugging Face 与 GitHub 上。该模型从人类视频中还原动作并离散化为 token 做预训练,可把同一份动作先验迁移到 LightBot、Unitree G1 等不同机器人本体上。
09/22 10:50
路透社:阿里巴巴计划推出5万亿至10万亿参数大模型,并发布新款芯片
路透社报道,阿里巴巴计划推出一款参数规模在5万亿至10万亿之间的人工智能大模型,并同时发布了一款新芯片。这条消息同时指向两条主线:模型规模继续向超大参数区间推进,以及自研芯片在算力供给中的地位继续上升。
09/22 07:40
浪潮信息发布元脑SD200 Ultra:单机承载2.8万亿参数Kimi K3
浪潮信息发布元脑SD200 Ultra,产品信息显示其可在单机内承载参数量达2.8万亿的Kimi K3模型。这一发布把超大模型的部署单元从集群拉回到单机,为需要私有化部署的用户提供了新的硬件选项,不过具体规格与实测表现尚未披露。
09/22 07:00
西班牙隐私监管机构调查一起由 AI 智能体驱动的网络攻击
据 teiss 报道,西班牙隐私监管机构正在调查一起由 AI 智能体驱动的网络攻击。这起案件把问题指向一个新的监管地带:当攻击动作由自主运行的软件发出,数据保护责任与行为归属该如何界定。