GEO资讯

OpenAI在欧盟上线textGrain文本水印,AI文本开始带隐形标记

发布于 2026/10/9 6 次阅读
OpenAI在欧盟上线textGrain文本水印,AI文本开始带隐形标记

10月5日,OpenAI给欧盟用户的AI文本加上隐形标记

10月5日,OpenAI宣布将在欧盟范围内为ChatGPT与Codex生成的文本加入隐形水印,方法名为textGrain,未来数周内逐步覆盖全部订阅档位。腾讯新闻转述环球网科技报道称,此举是OpenAI对欧盟监管要求的直接回应;Tenbrief、GetPack杂志等多家海外科技媒体同步跟进,细节口径一致。对每天用AI大模型写文案、维护官网内容的企业来说,机器生成的文字开始自带一层"出生证明",这件事值得认真看一眼。

监管是直接推手,行业早已在跟进

直接的推手是欧盟《人工智能法案》第50条:AI生成内容必须以"其他系统能够识别的方式"做标记,透明度义务今年8月2日正式适用,已上市系统获得到12月2日的过渡期。有意思的是,OpenAI在2024年8月曾因内部调研放弃过文本水印方案——当时近三成用户表示会因此减少使用(媒体报道口径)。两年后监管落地,这笔账只能重算。竞争对手的动作也不慢:Anthropic两个月前已宣布给Claude文本加水印并在全球推行,本站此前报道过那次上线。

textGrain怎么工作,边界在哪里

按OpenAI公布的技术报告,textGrain并不往文字里塞任何可见符号。模型在选词时,一个由密钥参与计算的信号会让候选词的选择产生轻微偏移,几百个词累积下来,形成读者察觉不到、检测器却能识别的统计模式。因为信号长在用词本身,文本被复制粘贴、导出PDF时标记会跟着走;公司称模型性能没有出现显著变化,水印也不识别具体用户身份。

检测能力是另一回事。OpenAI自报的测试数据显示,400词元长度的英文段落检测率约95%,200词元降到约80%;把一成词汇换成同义词,检测率就从约92%掉到66%,替换四分之一时只剩17%;数学解答、翻译文本以及英语之外的欧盟语言明显更弱,西班牙语约69%、罗马尼亚语约42.2%。基于这些边界,检测器初期只向经审核的研究机构与专家组织开放,普通教师、编辑暂时用不上。需要说明,上述数字均为厂商自报口径,独立复测尚未出现。

适用范围也要分清:欧盟内的ChatGPT与Codex用户默认启用,其他地区消费端暂不变;全球开发者可通过API自行开启,默认关闭。OpenAI同时表示,textGrain在其测试中不逊于包括SynthID-Text在内的同类方案,并计划开源,时间未定。

对企业官网内容的三个提醒

一是别把"合规"想成欧盟才有的事。生成式引擎在挑选信源时,真实性信号的权重正在上升——一篇能说清数据出处、有署名、可核验的页面,比匿名批量生产的文字更容易被AI搜索引用。用AI起草没有问题,发布前的人工核订与事实核对,价值只会更高。

二是短文案靠水印自证靠不住。按上述测试口径,两百词元(大致150个英文单词)以下检测率明显走低,而产品标题、卖点描述、页面摘要恰恰都在这个区间。企业内容的可信度,归根到底靠官网自身的事实层:资质、案例、可查证的数字,而不是指望一串隐形标记。

三是把它当成内容策略的计时器。极欧互联在GEO项目里一直建议客户把"人写加可核验"当作官网主内容的底线。当AI生成文本大规模可溯源,纯机器批量炮制的内容在生成式引擎那里的路会越走越窄,提前把事实资产做扎实,比事后补救省力得多。

趋势:文本、媒体、检测,溯源体系分层成型

把本周的消息连起来看,OpenAI在欧盟上线文本水印,谷歌同周把SynthID媒体检测器向公众开放,AI内容溯源正从单点技术变成分层体系:文本靠统计水印,图片视频音频靠像素与波形水印,检测入口走向公共化。OpenAI自己提醒得很清楚——没有水印不等于人写的,短文本、重度编辑、翻译都可能让信号消失。对企业来说,与其纠结检测技术能骗过谁,不如回到内容本身:说清事实、留好出处,让每一次被AI引用都经得起追溯。这是监管之外,水印技术给内容行业带来的真实压力测试。

信息来源