Rohan Paul
@rohanpaul_ai
来自 Google DeepMind 和其他顶尖实验室的一篇很棒的论文。
它提出了一种新型 AI 检测器,检测的是 AI 生成的想法,而不是文本或图像。
当 AI 依据一个人的完整大纲写作时,IdeaLens 将 7% 判定为 AI,而 Pangram 4 判定了 92%。在人们依据 AI 生成的大纲写出的 50 个故事上,IdeaLens 判定了 68%,而 Pangram 4 只判定了 8%。
他们发现,读取文档的大纲而不是其字句,能让检测器判断这些想法究竟来自人还是 AI。
一个只读取文档大纲的检测器就能判断想法是由人还是 AI 提出的,因此关于原创思考的规则不能依赖只评判措辞的检测器。
像 Pangram 这样的工具判断的是谁写了这些字,所以它们经常把经 AI 润色的人类作品标记出来,却漏掉由人写出来的 AI 想法。
IdeaLens 评判的是文档所提出要点的简短列表,并且是在改写过的列表上训练的,因此措辞无法帮到它。