10月6日消息,OpenAI宣布,为满足欧盟《人工智能法案》的透明度要求,将开始在欧盟地区为ChatGPT和Codex生成的文本加入一种人眼看不见的数字水印。
欧盟AI法案相关透明度规则已于8月2日生效,要求AI公司对AI生成内容进行技术标记,让其他系统能够识别内容可能由AI生成。
OpenAI表示,未来几周将在欧盟逐步向符合条件的ChatGPT和Codex用户上线这项功能,覆盖所有订阅套餐,但暂时仅限欧盟地区。
对于使用OpenAI API的开发者,情况有所不同。从现在开始,全球开发者都可以在部分模型上主动开启文本水印,不过默认状态仍然是关闭的。OpenAI目前没有计划在全球范围内默认启用。
这里所说的“水印”并不是在文章里加一个特殊符号,更不是在结尾标注“由ChatGPT生成”。
OpenAI采用了一种更加隐蔽的方式,通过轻微调整模型在生成文字时的词语选择,让大量词汇组合形成一种统计规律。普通读者看不出区别,但拥有相应检测工具和密钥的系统,可以通过这些规律判断文本是否可能由OpenAI模型生成。
因为这种水印直接存在于文字本身,所以即使用户把内容复制粘贴到其他网站或文档中,水印仍有可能保留下来。
OpenAI表示,这项技术不会记录或识别具体用户身份,而且在测试中,打开水印后并没有发现模型性能出现明显下降。
OpenAI还同步发布了一份技术报告,详细介绍名为textGrain的水印方法。该研究由OpenAI与宾夕法尼亚大学、耶鲁大学研究人员共同完成。
简单来说,在模型预测下一个词时,系统利用秘密密钥对候选词进行特定分类,并轻微影响模型最终选择。单独一次选择看不出什么,但当数百次这样的微小调整累积起来,就会形成可以通过算法识别的统计特征。
不过,这套水印并不牢不可破。
OpenAI自己的测试显示,只要把文章中10%的词替换成同义词,水印检测成功率就会从大约92%下降至66%。
此外,文本越短越难判断,数学答案、经过翻译的内容也更难稳定识别。
正因为存在这些局限,OpenAI暂时不会把检测工具全面开放给公众,而是先提供给经过批准的研究人员和专业机构,用于进一步验证准确性和探索合理使用方式。
OpenAI也特别提醒,没有检测到水印,并不能证明一段文字一定是人类写的。
原因很简单,这段文字可能太短,也可能被大量修改过,甚至可能是由其他公司的AI生成,本来就不包含OpenAI的水印。
反过来也一样。检测到水印最多只能说明OpenAI系统曾经生成或处理过这段内容的一部分,并不能证明整篇文章都是AI完成的,更无法判断其中有多少来自人的思考、编辑和创造。
在OpenAI之前,Anthropic已经在两个月前宣布给Claude生成的文本加入水印,而且采用全球范围执行的方式。
这一决定曾引发部分Claude用户不满。他们认为,实际工作中的指令、背景材料、判断和决策都由人完成,Claude只是一种辅助工具,因此不能简单把最终内容定义为AI作品。
事实上,OpenAI早在此前就开发过文本水印技术,但一直没有正式推出。《华尔街日报》2024年曾报道,其中一个顾虑就是,如果ChatGPT给文字强制加入水印,而竞争对手不这么做,部分用户可能会因此转向其他AI产品。
如今欧盟监管规则正式生效,OpenAI最终选择先在欧洲落地。
目前,Anthropic、Google、Meta、Microsoft和OpenAI等主要AI公司,都已经承诺遵守欧盟关于AI生成内容的相关行为准则。
扫码下载app 最新资讯实时掌握
