OpenAI要给ChatGPT的文本加水印了。不是为了防抄袭,是为了合规——欧盟AI法要求AI生成内容必须能被识别出来。这家公司宣布,将在未来几周内,面向欧盟用户推出文本水印功能,覆盖ChatGPT和Codex的所有付费计划。 但真正值得看的,是OpenAI自己公布的一组检测数据:未经编辑的AI文本,检测器识别率是 92% ;把文中10%的词换成同义词,识别率掉到 66% ;换掉25%,只剩 17% 。 水印怎么藏进文字里 这套水印不靠元数据,也不靠隐藏字符。它的做法是:在AI模型选词的时候,微妙地改变选择倾向,让生成的文本里留下一种人眼看不出的模式。检测器拿到文本后,通过识别这个模式来判断是不是AI写的。 因为水印嵌在单词本身,复制粘贴不会让它失效。OpenAI同时强调,水印不会让用户被识别出来,开启后模型的性能也不会有明显变化。 和这项功能一起发布的,还有一份关于检测技术「textGrain」的报告。不过OpenAI自己承认,水印不是万能的。 短文本、数学题、翻译,都是盲区 除了同义词替换会大幅拉低检测率,OpenAI还列出了几个检测困难的场景:短句子、数学答案、翻译后的文本。这些情况下,水印的识别效果都不理想。 正因如此,初期阶段检测器的访问权限被限制得很死——只有经过批准的研究人员和专业机构才能用。 OpenAI还专门发了一句提醒:没有水印,不能证明就是人写的。反过来,有水印只能说明AI参与了生成,但「无法判断其中投入了多少人类的判断、编辑和创造力」。 API开发者可以开,但默认是关的 对于全球使用OpenAI API的开发者,部分AI模型支持主动开启这项水印功能。但默认状态下它是关闭的。OpenAI表示,目前没有计划在全球范围内默认启用文本水印。 欧盟的AI法对AI生成内容提出了「可识别为人工生成」的标注要求。OpenAI这次的动作,是围绕这条规则做的合规部署。水印功能只针对欧盟圈内的用户,其他地区暂时不在覆盖范围内。 特别
发表评论