OpenAI 正在为欧盟地区全面启用“隐形”水印功能,对 ChatGPT 聊天文本及 Codex 代码输出进行标记。然而,其内部测试显示,只需将四分之一单词替换为同义词,水印检测率就会骤降至 17%。
此举旨在响应欧盟《人工智能法案》关于 AI 生成内容需具备机器可读标签的合规要求。不过,OpenAI 坦言相关技术尚不成熟,因此暂时未向公众开放检测工具。
ChatGPT 水印抗篡改能力究竟有多强?
根据 官方公告介绍,OpenAI 推出的该系统名为 textGrain,可通过调整模型用词,悄然嵌入潜在统计模式。后续检测器可识别并扫描文本中的特定隐性模式。
OpenAI 在常见问题解答中澄清,这种水印直接隐藏在用词本身,不会插入任何隐藏字符、不可见空格或特殊符号。因此,通过“清洗隐藏字符”进行规避的做法在这里并不适用。
文本长度成为关键影响因素。OpenAI 以“Token”(词元)来衡量文本容量,每个 Token 约等同于英语三个字母或三分之二个单词。
在 OpenAI 的实测中,检测器能识别约 150 个英文单词长度的原始回答,准确率达到 66%。若文本增至 300 个单词,检测成功率提升至约 92%。
轻微编辑同样会削弱 ChatGPT 的水印效力。当 300 个单词的文本中,每 10 个词有 1 个被同义替换时,检测成功率从 92% 降至 66%;若每 4 个词替换 1 个,检测率则大幅下滑,仅剩 17%。
值得注意的是,水印机制几乎未对 GPT-6 Astra(OpenAI 最新旗舰模型)的权威基准测试分数产生实质影响。
OpenAI 为何暂不对公众开放水印检测器?
目前,OpenAI 仅向合规研究人员及专业机构开放检测申请,并未提供任何公众在线工具。官方表示,检测结果为“阳性”时,不会透露用户、指令或对话内容等隐私信息。
但如果检测结果为“阴性”,实际意义有限。长度较短、经过编辑或翻译的文本,以及其他 AI 工具生成的内容,均可能绕过当前检测机制。
未检测到水印,并不意味着作品由人工创作。
来源:OpenAI
图片和音频文件则采取不同机制。任何人均可通过 OpenAI 官方验证工具上传相关文件,检查其是否嵌入 SynthID 水印。
在欧洲以外地区,ChatGPT 水印功能默认关闭。不过,目前全球范围内的 API 用户,可在项目或组织设置中自主选择支持的模型启用该功能。
此次功能上线与欧盟于 8 月正式实施的《AI 法案》透明度强制规定保持一致。具体到加密行业,合规重要性愈发凸显。根据 TRM Labs 数据,AI 辅助的加密犯罪同比激增 40%。
因此,监管机构的合规要求与检测技术的能力之间的差距,将持续影响主要 AI 实验室的合规策略和应对措施。









