OpenAI将在欧盟为ChatGPT与Codex文本加入隐形水印
导语
OpenAI宣布,将在欧盟为ChatGPT和Codex生成的文本加入不可见水印,以响应欧盟《人工智能法案》的透明度要求。相关规则已于8月2日生效,要求人工智能生成内容具备可被其他系统识别的标记。OpenAI计划在未来几周内,向欧盟符合条件的ChatGPT和Codex用户逐步推出这一功能,覆盖所有套餐。
核心要点
- 水印藏在文字模式中。 它不是可见符号,而是通过轻微调整模型对下一个词的选择,形成读者难以察觉、检测器可以识别的统计特征。由于特征存在于文本本身,内容在复制和粘贴后仍可能保留水印。
- 欧盟是首个默认推出区域。 OpenAI表示,初期不会在全球范围默认启用。与此同时,世界各地使用其API的开发者可以从当天起为部分模型手动开启该功能,但默认状态为关闭。
- 识别不是绝对可靠。 OpenAI的测试显示,替换约10%的词语后,检测率从约92%降至66%。较短的文本、数学答案和翻译内容也更难判断。没有检测到水印,并不能证明内容一定由人类创作,也可能意味着文本过短、被大量编辑,或来自其他人工智能系统。
- 不追踪具体用户。 OpenAI称,水印不会暴露用户身份,开启后也没有观察到模型性能出现有意义的变化。公司同时发布了名为textGrain的技术报告,介绍其利用秘密密钥对词语预测进行排序,再通过累积多次微调来完成检测的方法。
意义与影响
这项措施让AI生成内容的透明度从“附加说明”进一步转向机器可验证的技术标记,对教育、媒体、平台审核和监管执行都可能产生影响。但水印并不能回答一个更复杂的问题:一段文字中究竟有多少内容来自模型,又有多少体现了人的判断、编辑和创造力。经过轻度改写便可能降低检测效果,也说明它更适合作为来源线索,而不是单独用于处罚或认定作者身份的证据。
OpenAI此前曾开发过文本水印,但据报道因担心用户转向不采用水印的竞争产品而推迟发布。Anthropic随后宣布在全球范围为Claude文本加入水印,引发部分用户对“工具使用是否应被标记”的争论。随着OpenAI、Anthropic、Google、Meta和Microsoft等公司承诺遵循欧盟关于AI生成内容的实践准则,水印或将成为生成式AI合规竞争的一部分。不过,检测器的可访问范围、误判风险以及不同厂商之间的兼容性,仍需要持续评估。
评论
正在确认登录状态……
正在加载评论……