返回行业动态
企业AI落地

OpenAI 上线文本水印 textGrain:欧盟 ChatGPT 与 Codex 强制,全球 API 可选

OpenAI 于 10 月 5 日公布文本水印方案 textGrain。未来数周内欧盟地区 ChatGPT 与 Codex 的合规文本输出将逐步加入不可见统计水印;API 侧全球可选、默认关闭,检测器初期只向通过审核的研究者与专业机构开放。官方数据显示,替换 25% 词语后 400 token 文本的检出率会从约 92% 降至 17%。

来源:OpenAI 官方博客:Our approach to EU text provenance rules原标题:Our approach to EU text provenance rules查看原文
夜间深蓝色数据中心全景,成排机柜纵深延伸,中央悬浮一道由细密发光微粒组成的垂直光柱

图片来源:北京拓实科技原创(AI 生成封面)

发生了什么

OpenAI 于 2026 年 10 月 5 日公布文本水印方案 textGrain,用于回应欧盟《人工智能法案》对生成文本须可机器识别的要求。水印通过微调模型选词的概率分布嵌进文字本身,不含隐藏字符,因此复制粘贴后仍随文本保留。

  • 欧盟地区 ChatGPT 与 Codex 的合规文本输出将在未来数周逐步加水印,覆盖全部套餐
  • API 侧允许全球客户主动开启,默认关闭,微软 Azure 等云合作伙伴稍后接入
  • 检测器不公开,仅向通过审核的研究者与专家机构按欧盟实践准则逐案开放
  • 公司表示将把该技术开源,便于生态自行构建

检出率有多高

官方在 1% 目标误报率下的评测显示,文本长度与内容类型对检出率影响显著:400 token 的心理学类文本检出率约 95%,200 token 降至约 80%,数学类文本明显更低,因为选词自由度更小。

  • 400 token 文本替换 10% 词语后检出率由约 92% 降至 66%,替换 25% 降至 17%
  • 对 Astra 的八项基准评测中,加水印与不加水印未见显著性能差异
  • 技术报告由 OpenAI 与宾夕法尼亚大学、耶鲁大学研究者共同完成

企业该如何理解

水印只能提示某段文字可能与 OpenAI 模型有关,既不能识别用户、还原提示词,也不能证明作者身份;反过来,检测不到水印同样不能证明文字由人撰写。

  • 短文本、数学题、翻译文本以及经改写的内容都容易漏检
  • 若把水印作为内容审核或学术诚信依据,需先评估自身场景下的漏检与误报成本

不确定之处

欧盟之外是否跟进、与 Anthropic 采取的强制水印口径会否形成行业分歧、检测器何时扩大开放,OpenAI 均未给出时间表。

编辑说明

本文由北京拓实科技根据公开信息整理,核心事实与数据请以原始来源为准。