
为遵守《欧盟人工智能法案》(EU AI Act),OpenAI宣布将在欧盟境内生成的ChatGPT和Codex文本中添加隐形水印。该法案透明度规则已于8月2日生效,要求AI公司以可识别方式标记生成内容。
未来几周内,该功能将向欧盟地区所有符合条件的ChatGPT和Codex用户(含各订阅计划)逐步上线。全球开发者即日起可通过OpenAI API为选定模型手动开启此功能,但官方强调并未将其设为全球默认选项。
技术原理与局限性
这种水印并非可见符号,而是通过微妙影响模型用词选择,形成读者无法察觉但检测器可捕捉的模式。由于嵌入文字本身,即使复制粘贴,水印也会随之传播。OpenAI指出,水印不识别具体用户,且对模型性能无实质性负面影响。
伴随公告,OpenAI发布了由宾夕法尼亚大学和耶鲁大学研究人员共同撰写的技术报告textGrain,详解其方法:利用密钥对下一个词预测进行排序,累积数百次微调后,检测器仅凭文本和密钥即可识别AI生成内容。
然而,水印并非不可移除。测试显示,将10%词汇替换为同义词后,检测率从约92%降至66%。此外,短段落、数学答案及翻译文本更难被检测。鉴于这些局限,OpenAI决定最初仅向经批准的研究人员和专家组织开放检测器访问权限,以评估可靠性及负责任的使用场景。
OpenAI警告,缺少水印“并不能证明内容是人工创作的”,因为文本可能过短、经过大量编辑或来自其他AI产品。“[水印]只能表明某段内容由OpenAI系统生成或处理,无法反映其中的人类判断、编辑或创意投入。”
行业背景
此举紧随Anthropic两个月前宣布为Claude文本添加水印之后,后者正全球推行该举措,曾引发部分用户关于“AI仅为工具”的争议。据报道,OpenAI此前曾开发文本水印功能,但因担心用户流向无水印竞争对手而暂缓发布。目前,Anthropic、谷歌、Meta、微软和OpenAI等均承诺遵循欧盟关于AI生成内容的行为准则。