OpenAI将在欧盟为ChatGPT与Codex文本输出加入隐形水印,以满足AI透明度要求
据 IT之家 10 月 5 日消息,OpenAI 今日宣布,为配合《欧盟人工智能法案》关于内容透明度的要求,未来几周将在欧盟地区面向符合条件的 ChatGPT 和 Codex 用户,逐步为文本输出加入机器可识别的隐形水印。这一水印不会以肉眼可见的标记呈现,而是通过模型生成文本时的选词过程嵌入统计信号,用于后续识别文本是否来自带有 OpenAI 水印机制的模型输出。
OpenAI 将这项文本水印技术称为 textGrain(文本粒水印)。来源显示,该技术会在模型生成文本时,将不可见的统计特征嵌入到输出文本中;检测器则通过识别这些特征,判断一段文本是否包含 OpenAI 水印。换句话说,它并不是在文章末尾添加声明,也不是改变排版样式,而是在生成机制层面为文本留下可被机器识别的“来源线索”。
先在欧盟落地:不是全球默认开启
从部署范围看,OpenAI 此次选择了较为审慎的路线。来源显示,OpenAI 下一步将在欧盟推广文本水印,并将在未来几周内,仅向欧盟地区所有计划中符合条件的 ChatGPT 和 Codex 用户引入该功能。值得注意的是,OpenAI 不会在发布时把文本水印设置为全球默认选项。
这意味着,面向全球用户的 ChatGPT 与 Codex 文本输出暂时不会自动全部带有水印。对于 API 客户,OpenAI 将提供选择加入的方式:从今天起,全球 API 客户可以选择让部分模型生成带水印的文本输出。OpenAI 的说法是,这样可以让客户自行判断水印机制如何匹配自身的透明度义务,以及如何影响最终用户体验。
- 欧盟优先:未来几周在欧盟地区面向符合条件的 ChatGPT 和 Codex 用户引入。
- API 可选:全球 API 客户可选择为部分模型启用带水印输出。
- 云服务跟进:OpenAI 正与云合作伙伴合作,未来几周为通过其服务访问的模型输出提供水印能力。
- 检测器受控开放:研究人员和专家组织可申请访问检测工具,初期按具体情况逐案授予。
检测器能判断水印,但不暴露用户与对话内容
围绕 AI 生成内容的识别,检测工具的边界同样关键。来源显示,OpenAI 将向研究人员和专家组织提供探测器访问权限,获批对象可以从今天开始申请。初期访问将根据行为准则按个案授予,用于支持文本来源评估以及相关改进工作。
OpenAI 表示,该工具会报告是否检测到 OpenAI 水印,但不会透露用户身份、提示词内容或对话内容。对中文读者和企业用户而言,这一点值得关注:水印检测如果要被教育、出版、企业合规或平台治理采用,必须在“可追溯”和“隐私保护”之间取得平衡。此次披露的信息显示,OpenAI 更强调识别文本是否带有其水印,而不是把检测器做成可反查用户行为的系统。
影响解读:AI内容治理从“事后猜测”走向“生成时标记”
过去一段时间,AI 文本检测常常依赖分类器判断,容易受到文本改写、翻译、人工润色等因素影响。textGrain 代表的思路则有所不同:它试图在文本生成阶段就嵌入可检测信号,让内容来源判断从“事后推测”转向“生成时标记”。如果这种方式在更多场景中采用,平台、企业和研究机构将拥有更明确的技术抓手来识别部分 AI 生成文本。
不过,水印机制也并不等同于解决所有 AI 内容治理问题。首先,它只覆盖启用了水印的模型和场景;其次,OpenAI 目前并未将其设为全球默认;再次,检测权限初期也并非完全开放。因此,短期内它更像是一项面向监管合规、研究评估和企业透明度需求的基础能力,而不是面向所有互联网文本的通用判定标准。
从产业趋势看,欧盟监管正在推动头部模型厂商把透明度、来源识别和用户告知纳入产品设计。对于使用 ChatGPT、Codex 或 OpenAI API 构建产品的开发者和企业来说,未来可能需要更明确地考虑:哪些输出需要标记、如何向用户说明、是否启用水印,以及水印对内容分发、版权、合规审计和用户信任的影响。
总体来看,OpenAI 在欧盟推出文本隐形水印,是生成式 AI 从能力竞争走向治理竞争的又一信号。随着《欧盟人工智能法案》等规则进入落地阶段,模型厂商不只要提升性能,也要把可识别、可审计、可解释的内容机制纳入基础设施。对于中文 AI 产业观察者而言,这类合规能力未来很可能成为大模型产品出海、企业采购和平台接入时的重要评估项。