技术

OpenAI 推出符合欧盟法律的文本水印功能

2026/10/6 14:27 • 尤金尼亚·斯利夫

(已编辑:2026/10/06)

OpenAI 推出符合欧盟法律的文本水印功能

OpenAI 推出了文本内容的水印功能,以符合欧盟人工智能法的要求。在接下来的几周内,公司计划将数字水印应用于 ChatGPT 和 Codex 模型的文本输出,供欧盟使用。然而,与 Anthropic 的类似技术不同,OpenAI 不打算将此技术应用于欧洲以外生成的内容,尽管 API 客户可以选择将标记应用于任何生成的信息。

OpenAI 的水印技术并不总是能够识别生成的 AI 文本,并且可能很容易被欺骗。根据人工智能法的要求,生成性 AI 的提供者必须使模型的输出对机器可读。Anthropic 公司率先宣布其遵守人工智能法的方法,在全球范围内应用 Google SynthID-Text 算法。微软和 Meta 也在为图像开发类似技术,因为关于内容来源和使用生成性 AI 进行虚假信息传播的担忧不仅在欧洲存在。OpenAI 使用了一种名为 textGrain 的水印方法,该方法“向模型的词语选择中添加了不可见的统计信号”。该检测器分析此信号以确定文本是否包含 OpenAI 的水印。模型根据可能词语的概率分布逐个预测词语。通过周期性地选择另一个词,理想情况下– 同义词,文本偏离了无偏模型形成的统计模式。

理论上,检测器应该标记这种用词变化。预期错误率为百分之一,但在 200 字的短文本中,检测器只能检测到 80% 的水印,而在 400 字的文本中则为 95%。对于功能性文本,如数学或代码片段,结果也较差,因为词语替换更可能引入错误。textGrain 文档未考虑统计上改变的词语选择可能改变所述内容的意义的情况。如果算法更改了任何重要事实或数字,这仍然是可能的。Anthropic 的方法也替换输出中的某些词语,尽管使用了不同的算法,但存在类似的风险。无论如何,OpenAI 的水印很容易通过替换词语来中和。在 400 词段落的测试中,用同义词替换 10% 的词语将水印检测率从 92% 降至 66%。替换 25% 的词语时,仅有 17% 的水印可以被检测到。因此,结果表明,为遵守法规而进行的更改可能不如计划的那样可靠。

本材料仅供参考,不构成财务建议或推荐。

热门新闻