与此主题相关未来科技与人工智能委员会

ChatGPT 增添水印功能 OpenAI 推出检测工具

  • OpenAI 在欧盟为 ChatGPT 文本添加隐形水印
  • 同义词替换 25% 单词后检测率降至 17%
  • OpenAI 文本检测工具暂仅对特定研究员开放

OpenAI 正在为欧盟地区全面启用“隐形”水印功能,对 ChatGPT 聊天文本及 Codex 代码输出进行标记。然而,其内部测试显示,只需将四分之一单词替换为同义词,水印检测率就会骤降至 17%。

此举旨在响应欧盟《人工智能法案》关于 AI 生成内容需具备机器可读标签的合规要求。不过,OpenAI 坦言相关技术尚不成熟,因此暂时未向公众开放检测工具。

ChatGPT 水印抗篡改能力究竟有多强?

根据 官方公告介绍,OpenAI 推出的该系统名为 textGrain,可通过调整模型用词,悄然嵌入潜在统计模式。后续检测器可识别并扫描文本中的特定隐性模式。

OpenAI 在常见问题解答中澄清,这种水印直接隐藏在用词本身,不会插入任何隐藏字符、不可见空格或特殊符号。因此,通过“清洗隐藏字符”进行规避的做法在这里并不适用。

文本长度成为关键影响因素。OpenAI 以“Token”(词元)来衡量文本容量,每个 Token 约等同于英语三个字母或三分之二个单词。

在 OpenAI 的实测中,检测器能识别约 150 个英文单词长度的原始回答,准确率达到 66%。若文本增至 300 个单词,检测成功率提升至约 92%。

轻微编辑同样会削弱 ChatGPT 的水印效力。当 300 个单词的文本中,每 10 个词有 1 个被同义替换时,检测成功率从 92% 降至 66%;若每 4 个词替换 1 个,检测率则大幅下滑,仅剩 17%。

随着词语替换增多,ChatGPT 水印检测率大幅降低
ChatGPT 水印检测率随文本编辑而变化。来源:OpenAI

值得注意的是,水印机制几乎未对 GPT-6 Astra(OpenAI 最新旗舰模型)的权威基准测试分数产生实质影响。

OpenAI 为何暂不对公众开放水印检测器?

目前,OpenAI 仅向合规研究人员及专业机构开放检测申请,并未提供任何公众在线工具。官方表示,检测结果为“阳性”时,不会透露用户、指令或对话内容等隐私信息。

但如果检测结果为“阴性”,实际意义有限。长度较短、经过编辑或翻译的文本,以及其他 AI 工具生成的内容,均可能绕过当前检测机制。

未检测到水印,并不意味着作品由人工创作。

来源:OpenAI

图片和音频文件则采取不同机制。任何人均可通过 OpenAI 官方验证工具上传相关文件,检查其是否嵌入 SynthID 水印。

在欧洲以外地区,ChatGPT 水印功能默认关闭。不过,目前全球范围内的 API 用户,可在项目或组织设置中自主选择支持的模型启用该功能。

此次功能上线与欧盟于 8 月正式实施的《AI 法案》透明度强制规定保持一致。具体到加密行业,合规重要性愈发凸显。根据 TRM Labs 数据,AI 辅助的加密犯罪同比激增 40%。

因此,监管机构的合规要求与检测技术的能力之间的差距,将持续影响主要 AI 实验室的合规策略和应对措施。

文章免责声明

BeInCrypto 致力于提供公正、透明的报道。本新闻文章旨在提供准确、及时的信息。但读者仍应自行独立核实事实,并在根据本内容作出任何决定之前咨询专业人士。请注意,我们的条款与条件、隐私政策及免责声明已更新。