实时 AI 消息
OpenAI 将在欧盟为 ChatGPT 文本加入隐形水印
OpenAI 宣布,将在欧盟范围内为 ChatGPT 与 Codex 生成的文本加入隐形水印,以满足《欧盟人工智能法案》的透明度要求。水印会在未来数周内先在欧盟上线,编辑可以削弱其可检测性,因此 OpenAI 目前只向经过审核的研究人员开放检测器。
OpenAI 宣布,将在欧盟范围内为 ChatGPT 与 Codex 生成的文本加入隐形水印,以满足《欧盟人工智能法案》的透明度要求。该消息由 OpenAI 于周一在官方博客中发布,TechCrunch 当天进行了报道。
根据 OpenAI 的说明,水印会在未来数周内逐步向欧盟地区符合条件的 ChatGPT 和 Codex 用户推出,覆盖所有订阅套餐,但仅限欧盟用户。全球范围内使用 OpenAI API 的开发者,即日起可为部分模型手动开启该功能,默认处于关闭状态。OpenAI 表示,上线初期不会把文本水印设为全球默认。
水印并非可见符号,而是通过微妙地调整模型的用词选择,形成一种读者看不见、但检测器能够识别的模式。由于它存在于文字本身,复制粘贴文本时水印会随文本一同移动。OpenAI 强调,水印不会识别用户身份,且开启后模型性能没有出现明显变化。
与公告同步发布的还有一份技术报告,其方法名为 textGrain,由 OpenAI 与宾夕法尼亚大学、耶鲁大学的研究人员共同撰写。报告描述了用一把密钥对下一个词的预测进行排序以完成句子的过程;当这类微调累积到数百次后,检测器仅凭文本和密钥就能判断内容是否由 AI 生成。
OpenAI 的测试也显示,水印可以通过编辑被去除。在一次测试中,将 10% 的词语替换为近义词,检测率从约 92% 降到 66%;短段落、数学答案以及翻译文本也更难被检测。这些局限正是 OpenAI 初期只向经过审核的研究人员和专业机构开放检测器的原因。
OpenAI 还提醒,缺少水印并不能证明内容由人撰写——文本可能太短、被大幅编辑,或者来自其他公司的 AI。水印可以说明某个 OpenAI 系统生成或处理了段落的一部分,但无法说明其中有多少人类判断、编辑或创造性。
这一宣布距 Anthropic 表示将对 Claude 生成的文本加水印约两个月。欧盟《人工智能法案》的透明度规则已于 8 月 2 日生效,要求 AI 公司以其他系统可识别的方式标记 AI 生成内容。对 OpenAI 来说,先在欧盟落地、全球暂不默认,既回应了监管要求,也保留了后续调整的空间。
接下来值得关注的是:水印在真实使用中的检测可靠性究竟如何,开发者是否愿意主动为 API 开启该功能,以及欧盟监管机构会如何认定“可识别标记”的实际效果。
为什么重要
OpenAI 在欧盟先行加水印,是主要模型厂商对《欧盟人工智能法案》透明度规则的一次实质性落地。由于水印可被编辑削弱,它更适合作为溯源线索,而非内容真伪的定论。
附近消息
全部10/06 04:36
Meta 发布 Muse Gadgets SDK:给 Muse 接上屏幕、按键和家里的设备
Meta 推出了 Muse Gadgets SDK,开发者可以借此打造围绕 Muse AI 运行的自定义硬件,为设备接上屏幕、按键,并连接家中的其他设备。这是 Meta 把 Muse 从软件助手延伸到第三方硬件生态的一步。
10/06 04:15
The Next Web:OpenAI 自研模型重塑其 Jalapeño 芯片,部分改动难以解释
据 The Next Web 报道,OpenAI 的模型被用于重塑其 Jalapeño 芯片,但其中一些改动连公司自身也难以完全解释。这一细节说明 AI 正在进入芯片设计环节,同时也暴露出可解释性上的缺口。
10/06 04:00
英伟达押注“美国版 DeepSeek”,将推出开放权重模型
有媒体报道称,英伟达正押注被称为“美国版 DeepSeek”的开放权重路线,并准备推出自己的开放权重模型。这意味着这家以芯片与算力为核心的巨头正进一步走向模型生态,直面中国开放权重模型带来的竞争。
10/06 03:58
加州就 AI 智能体网络安全漏洞向 OpenAI 发出传票
据 Security Boulevard 报道,加州已就涉及 AI 智能体的网络安全漏洞向 OpenAI 发出传票。此举意味着州层面开始以正式法律手段介入智能体安全问题。