发生了什么
OpenAI 于 2026 年 10 月 5 日公布文本水印方案 textGrain,用于回应欧盟《人工智能法案》对生成文本须可机器识别的要求。水印通过微调模型选词的概率分布嵌进文字本身,不含隐藏字符,因此复制粘贴后仍随文本保留。
- 欧盟地区 ChatGPT 与 Codex 的合规文本输出将在未来数周逐步加水印,覆盖全部套餐
- API 侧允许全球客户主动开启,默认关闭,微软 Azure 等云合作伙伴稍后接入
- 检测器不公开,仅向通过审核的研究者与专家机构按欧盟实践准则逐案开放
- 公司表示将把该技术开源,便于生态自行构建
检出率有多高
官方在 1% 目标误报率下的评测显示,文本长度与内容类型对检出率影响显著:400 token 的心理学类文本检出率约 95%,200 token 降至约 80%,数学类文本明显更低,因为选词自由度更小。
- 400 token 文本替换 10% 词语后检出率由约 92% 降至 66%,替换 25% 降至 17%
- 对 Astra 的八项基准评测中,加水印与不加水印未见显著性能差异
- 技术报告由 OpenAI 与宾夕法尼亚大学、耶鲁大学研究者共同完成
企业该如何理解
水印只能提示某段文字可能与 OpenAI 模型有关,既不能识别用户、还原提示词,也不能证明作者身份;反过来,检测不到水印同样不能证明文字由人撰写。
- 短文本、数学题、翻译文本以及经改写的内容都容易漏检
- 若把水印作为内容审核或学术诚信依据,需先评估自身场景下的漏检与误报成本
不确定之处
欧盟之外是否跟进、与 Anthropic 采取的强制水印口径会否形成行业分歧、检测器何时扩大开放,OpenAI 均未给出时间表。

