塔斯娱乐资讯网

以后在欧盟用ChatGPT写出来的东西,可能自带一个你看不见的"指纹"。但这个指

以后在欧盟用ChatGPT写出来的东西,可能自带一个你看不见的"指纹"。但这个指纹有个尴尬的弱点:改几个词,它可能就没了。
10月5日,OpenAI发布了一套文本水印方案,技术名叫textGrain,用来回应欧盟《人工智能法案》的透明度要求。法案规定,生成式AI提供方必须让机器能识别出哪些文本是AI生成的。
先把"它不是什么"说清楚。
不是打个可见标记,不是塞隐藏字符,也不是在文件里写元数据。textGrain干的事更隐蔽:它在模型生成的时候,微调"下一个词选哪个"的概率。技术报告给的例子是,用一个密钥去给模型的选词排序;这种微小的偏置累积几百次之后,检测器拿着密钥和文本,就能判断这段文字里有没有OpenAI的水印。因为水印藏在词里,复制粘贴到别处,它也跟着走。
部署分三步走:全球的API客户,即日起可以给部分模型开启水印,默认是关闭的;未来几周,欧盟地区的ChatGPT和Codex会逐步加上隐形水印;水印检测器的权限,只开放给经过审批的研究人员和专家机构,一个一个批。
为什么检测器不公开?因为这东西的可靠性还差得远。
OpenAI自己公布的数据是这样的。在把误报率控制在1%的前提下,200个token的心理学内容,检出率约80%;同样内容写到400个token,检出率升到约95%。换成数学题就明显变差——数学的用词余地小,模型没法自由"选词"。更麻烦的是编辑:400个token的段落里,把10%的词换成同义词,检出率从约92%掉到66%;换掉25%,直接掉到17%。翻译和大幅改写,同样会冲淡这个信号。
所以它真正能证明的事,非常有限。
检出到水印,只能说明OpenAI的系统生成或处理过其中一部分内容。它不能识别是哪个用户、哪个账号、哪次对话,也不能证明版权归属、内容是真是假,更没法算出这段文字里人类贡献了多少。反过来,检测不到水印,也不能证明文字是人写的——可能太短、可能被改过、可能来自别家模型。
这也不是OpenAI一家的动作。两个月前,Anthropic已经在全球范围给Claude的文本加水印,当时还引来部分用户抗议,理由是"指令、背景和决策都是我给的,AI只是工具"。而OpenAI自己在2024年就做过文本水印,后来按下了暂停键,据报道是担心用户流向不加水的竞争对手。
这次先只在欧盟推、先只给研究者用,更像是把监管要求和技术的真实水平放在一起,做的一次公开试验。
有个问题挺值得琢磨:一份"能被机器认出来"的AI文本,到底是在保护透明度,还是会让"改几个词就能洗掉"的水印,最终变成走过场?你怎么看?