OpenAI 在 2026 年 10 月 5 日通过官方博客公布 textGrain 文本水印方案,回应欧盟对生成内容溯源的要求。未来几周内,欧盟地区符合条件的 ChatGPT 和 Codex 文本输出将逐步带上这种水印,覆盖各个套餐;全球范围的 API 客户则从即日起可对部分模型选择性开启,默认并不打开。
水印藏在选词里,不在字符里
textGrain 的做法是在模型生成文字时,把不可见的统计信号嵌进选词过程:读者看到的仍是普通句子,没有隐藏字符、隐形空格,也不携带用户身份信息。日后用配套检测器检查同一段文字时,可以根据生成时留下的统计模式判断它是否出自带水印的模型。这和事后用分类器猜一段话像不像机器写的不同,前者查的是生成当时埋下的信号,后者只能凭文风推测,准确性不在一个层面上。
检测器暂时不向普通用户开放
需要注意的是,配套检测器现阶段只向获批的研究者和专家机构开放,普通读者拿到一段疑似 ChatGPT 写的文字,并没有官方工具可以当场验真伪。对欧盟普通用户来说,这次变化的实际影响主要是自己产出的文本将来可能被平台和机构检出,而对 API 开发者来说,要不要开启是一个主动选择:开启后输出可溯源,不开启则维持现状。OpenAI 还表示,API 侧的水印未来几周也会经微软 Azure 等云合作伙伴提供。
信号会被改写削弱,这一点官方没有回避
文本水印有一个绕不开的弱点:改写、删改和大幅编辑都可能削弱甚至抹掉统计信号。换句话说,检测出水印可以作为来源证据,但检测不出水印,不能反过来证明一段文字一定是真人写的。把这项技术当作内容治理的唯一凭据并不合适,它更适合与平台标注、发布规范一起使用。接下来值得观察的是欧盟以外地区是否跟进,以及检测器何时、以什么方式向更多机构开放。