OpenAI将在欧盟为ChatGPT文本加隐形水印
OpenAI 10月5日宣布,为配合欧盟《人工智能法案》的内容透明度要求,未来几周将在欧盟地区符合条件的 ChatGPT 和 Codex 文本输出中加入机器可识别的隐形水印。这套文本水印技术名为 textGrain(文本粒水印),即日起全球 API 客户也可以选择为部分模型开启水印输出。

textGrain 的原理是在模型选词过程中嵌入不可见的统计信号,检测器通过识别这一信号,判断一段文本是否带有 OpenAI 水印。OpenAI 称官方评测显示其表现与测试过的其他方案持平或更优,技术细节将在后续技术报告中公布。
按照安排,未来几周团队将先在欧盟向符合条件的 ChatGPT 与 Codex 用户引入文本水印,发布时不会将其设为全球默认。OpenAI 同时在与云服务商合作,让通过其平台访问 OpenAI 模型的输出同样支持水印。研究人员和专家组织即日起可以申请检测器访问权限,初期将逐案批准;检测工具只报告是否检测到 OpenAI 水印,不会透露用户身份、提示词或对话内容。
评测同时披露了技术局限:文本越短、措辞约束越强,检测难度越大。在 1% 目标误报率下,200 词段落的检出率约为八成,400 词段落约九成五,数学类内容的检出率明显更低。人工编辑也会削弱水印——替换 10% 的同义词后,检出率从约 92% 降至 66%,替换 25% 则降至 17%,这也是检测器暂不全面公开的原因之一。
对输出质量的影响方面,OpenAI 称在前沿模型的多项基准测试中,开启水印前后成绩没有出现有意义差异。公司同时强调水印的能力边界:它不能衡量人类的贡献程度,不能确立文本的所有权或责任归属,也不能验证内容真伪;未检出水印同样不能证明文本出自人类。图像与音频验证工具目前仍保持公开可用。
编译自 OpenAI 官方公告(IT之家报道),原标题:"OpenAI 将在欧盟为 ChatGPT 和 Codex 文本输出添加隐形水印"