OpenAI 近日宣布,将在欧盟范围内默认对 ChatGPT 生成的文本自动添加水印,而在欧盟以外的其他地区,这项功能虽然也会提供,但默认处于关闭状态,用户需要手动开启。这一差异化策略的背后,是欧盟《人工智能法案》的合规压力。该法案已于今年 8 月正式生效,其中明确要求,AI 模型生成的内容必须以某种可被其他工具识别的方式加以标记,以便监管机构和公众区分人工创作与机器生成内容。对于在欧盟运营的 AI 服务商而言,这已不是可选项,而是必须落实的法律义务。
从技术实现来看,OpenAI 将这套水印方案命名为 textGrain,并已发布技术论文解释其原理。总体而言,它的工作方式与业界此前见过的其他大语言模型水印工具类似:系统会在模型选择用词时嵌入某种不易被人类读者察觉的模式,这种模式不会明显影响输出文本的总体质量,但掌握密钥的一方可以借助专门的检测器将其识别出来。OpenAI 表示,检测器的访问权限将仅向有限数量的研究人员开放,以避免被滥用或逆向破解。不过,公司并未披露水印的具体强度、误报率以及在改写、翻译、截断等常见操作下的存活率。
值得注意的是,水印技术目前仍面临根本性的可靠性挑战。业界已有的若干标准,例如 SynthID 和 C2PA 项目,虽然提供了一定的内容溯源能力,但对于具备基本技术知识的人来说,绕过它们并不困难。OpenAI 的 textGrain 很可能也面临同样的问题。这意味着,水印更多是一种威慑和辅助识别手段,而非万无一失的证明工具。对于普通用户而言,欧盟地区默认开启水印不会改变 ChatGPT 的使用体验,但生成内容的可追溯性将有所提升;对于其他地区的用户,是否开启则取决于自身需求与对隐私、创作归属的考量。这一举措也预示着,全球 AI 内容标识的监管趋势正在加速,未来可能有更多司法辖区跟进类似要求。
