
8月2日,欧盟《人工智能法案》(EU AI Act)的透明度规则正式生效,要求 AI 厂商以可被其他系统识别的方式标记 AI 生成内容。OpenAI 于本周一宣布,将为欧盟地区的 ChatGPT 和 Codex 文本引入不可见水印机制,以满足合规要求。
水印原理:藏在词选之中,随复制粘贴流动 该水印并非可见符号,而是通过细微调整模型的词汇选择,在文本中留下人眼无法察觉、但专用检测器可以识别的隐藏模式。由于水印嵌入在文字本身,复制粘贴后依然保留。
OpenAI 同步发布了技术报告 textGrain(与宾夕法尼亚大学、耶鲁大学研究者合著),详细说明了具体做法:用密钥对"下一个词"的预测概率进行排序,引导模型在数百个位置做出微调,最终检测器仅凭文本和密钥即可判断内容是否由 AI 生成。
OpenAI 同时指出,该水印无法识别具体用户,且开启后模型性能未出现明显变化。
局限性:编辑可削弱检测,特定内容类型更难识别 OpenAI 的测试表明,水印并非不可去除。将 10% 的词汇替换为同义词后,检测准确率从约 92% 下降至 66%。此外,短文本、数学答案以及经过翻译的内容检测难度更高。
该公司同时提醒:水印缺失不等于内容出自人类——可能是文本过短、经过大量编辑,或来自其他 AI 厂商的系统。
"水印可以表明文本由 OpenAI 系统生成或处理,但不能说明其中融入了多少人工判断、编辑或创意。" OpenAI 在博客中写道。
鉴于上述局限,OpenAI 初期仅向经审批的研究机构和专家组织开放检测器访问权限,以共同评估可靠性并探索负责任的使用场景。
行业动向:Anthropic 已率先全球推行,五大厂商承诺遵守欧盟守则 值得注意的是,Anthropic 已在两个月前宣布为 Claude 生成文本添加水印,且适用全球范围,但该决定引发部分用户反弹,认为"指令、上下文、决策均由用户完成,Claude 只是工具"。
《华尔街日报》2024 年报道,OpenAI 此前已开发文本水印技术,但一度暂缓发布,部分原因在于担心用户转向未添加水印的竞争对手。
目前,Anthropic、Google、Meta、Microsoft 和 OpenAI 均已承诺遵守欧盟关于 AI 生成内容的透明度实践守则。


评论