一段 AI 生成的文字被复制、改写后,平台还能认出它吗?这正是欧盟新规带来的难题。文本不像图片,几次换词或翻译就可能抹掉来源线索。据 OpenAI 介绍,公司将于未来数周为欧盟地区符合条件的 ChatGPT 和 Codex 文本输出加入不可见水印;全球 API 客户也可在部分模型中主动启用,但默认关闭。欧盟《AI法案》第50条的相关透明度义务已于 2026 年 8 月 2 日起适用,要求合成内容带有机器可读、可检测的标记。
这套技术名为 textGrain。它会在模型选词时埋入统计信号,像给措辞留下肉眼看不见的纹理。检测器只回答“是否发现 OpenAI 水印”,不识别用户,也不披露提示词或对话。OpenAI 称,在假阳性率设为 1% 的测试中,约 200 Token(模型处理文字的基本单位)的部分文本检出率约为 80%,400 Token 时约为 95%;但数学等选词空间较小的内容更难识别。
水印也很脆弱:400 Token 英文文本替换 10% 的词后,检出率从约 92% 降至 66%;替换 25% 后只剩 17%。因此,检测器初期仅向获批研究人员和专业机构开放申请。OpenAI也明确承认,短文本、编辑和翻译会造成漏检,系统还可能误报;检测结果不能单独当作作者身份或违规证据。