郭震 AI公众号:郭震AI

实时 AI 消息

OpenAI 将在欧盟为 ChatGPT 文本加入隐形水印

OpenAI 宣布,将在欧盟范围内为 ChatGPT 与 Codex 生成的文本加入隐形水印,以满足《欧盟人工智能法案》的透明度要求。水印会在未来数周内先在欧盟上线,编辑可以削弱其可检测性,因此 OpenAI 目前只向经过审核的研究人员开放检测器。

发布时间

OpenAI 宣布,将在欧盟范围内为 ChatGPT 与 Codex 生成的文本加入隐形水印,以满足《欧盟人工智能法案》的透明度要求。该消息由 OpenAI 于周一在官方博客中发布,TechCrunch 当天进行了报道。

根据 OpenAI 的说明,水印会在未来数周内逐步向欧盟地区符合条件的 ChatGPT 和 Codex 用户推出,覆盖所有订阅套餐,但仅限欧盟用户。全球范围内使用 OpenAI API 的开发者,即日起可为部分模型手动开启该功能,默认处于关闭状态。OpenAI 表示,上线初期不会把文本水印设为全球默认。

水印并非可见符号,而是通过微妙地调整模型的用词选择,形成一种读者看不见、但检测器能够识别的模式。由于它存在于文字本身,复制粘贴文本时水印会随文本一同移动。OpenAI 强调,水印不会识别用户身份,且开启后模型性能没有出现明显变化。

与公告同步发布的还有一份技术报告,其方法名为 textGrain,由 OpenAI 与宾夕法尼亚大学、耶鲁大学的研究人员共同撰写。报告描述了用一把密钥对下一个词的预测进行排序以完成句子的过程;当这类微调累积到数百次后,检测器仅凭文本和密钥就能判断内容是否由 AI 生成。

OpenAI 的测试也显示,水印可以通过编辑被去除。在一次测试中,将 10% 的词语替换为近义词,检测率从约 92% 降到 66%;短段落、数学答案以及翻译文本也更难被检测。这些局限正是 OpenAI 初期只向经过审核的研究人员和专业机构开放检测器的原因。

OpenAI 还提醒,缺少水印并不能证明内容由人撰写——文本可能太短、被大幅编辑,或者来自其他公司的 AI。水印可以说明某个 OpenAI 系统生成或处理了段落的一部分,但无法说明其中有多少人类判断、编辑或创造性。

这一宣布距 Anthropic 表示将对 Claude 生成的文本加水印约两个月。欧盟《人工智能法案》的透明度规则已于 8 月 2 日生效,要求 AI 公司以其他系统可识别的方式标记 AI 生成内容。对 OpenAI 来说,先在欧盟落地、全球暂不默认,既回应了监管要求,也保留了后续调整的空间。

接下来值得关注的是:水印在真实使用中的检测可靠性究竟如何,开发者是否愿意主动为 API 开启该功能,以及欧盟监管机构会如何认定“可识别标记”的实际效果。

为什么重要

OpenAI 在欧盟先行加水印,是主要模型厂商对《欧盟人工智能法案》透明度规则的一次实质性落地。由于水印可被编辑削弱,它更适合作为溯源线索,而非内容真伪的定论。

微博邮件

OpenAIEU AI ActPolicyChatGPT
返回实时消息

附近消息

全部