Rohan Paul
@rohanpaul_ai
OpenAI 将在欧盟为 ChatGPT 和 Codex 生成的文本加上隐形水印。
水印只会加在 ChatGPT 或 Codex 写出的文本中。所以如果欧盟有人让 ChatGPT 写一段话并粘贴到个人博客上,这个隐藏信号会随这些文字一起传播,因为它存在于用词选择的模式中,而不是任何特殊字符里。
如果那个人大幅改写,信号就会减弱,甚至可能消失。人自己写的任何内容都完全不带水印。
各个套餐的符合条件用户将在未来几周内获得该水印,而全球 API 客户今天就可以为部分模型开启它。
公众无法使用 OpenAI 用来检测文本是否带有水印的工具
此次推出是为了回应欧盟《人工智能法》第 50 条,8 月 2 日前已上市的生成式系统必须在……之前带上机器可读标记
没人能用肉眼看出来,因为文本读起来和普通文本完全一样:没有标记,没有奇怪字符,读者、编辑或老师都不会察觉。
唯一的发现方式是把文本放进 OpenAI 的检测器,而目前 OpenAI 只把这个工具留给自己,以及一小部分逐一申请并获批的研究人员和专业机构。
这套方案名为 textGrain,它会让模型的用词选择发生偏移,留下读者看不见、但检测器可以测量的统计信号。
在 1% 误报率下,OpenAI 测试中该检测器识别出了约 80% 的 200 token 心理学段落,以及约 95% 的 400 token 段落。
数学答案的得分明显更低,因为措辞严谨,可互换的词更少,能承载信号的空间也更小。
编辑也会削弱水印:在 400 token 的段落中把 10% 的词换成同义词,检测率从约 92% 降到 66%;替换 25% 则降到 17%。
阳性结果无法识别任何用户、提示词或所有者,而阴性结果也说明不了多少,因为短文本、编辑过、翻译过或由其他模型生成的文本都能逃过检测。