NeFut Logo NeFut
EN 管理员登录

[AI学术] 欧盟AI法案后:无验证的水印与治理挑战

发布于:2026-09-12 22:00 最后更新:2026-09-15 01:15
#AI #LLM

2026年8月2日,欧盟《AI法案》第50条义务生效,要求生成式AI提供商对系统产出进行标记并可检测为AI生成。随后,Anthropic宣布自该日期起发布的所有Claude模型在生成文本中默认嵌入基于SynthID-Text的水印,用户无法关闭;Google自2024年起在Gemini中部署了同样的技术。用户指出水印降低了文本质量,尤其是代码,且暗藏可识别信息,并且水印既易于移除又不可避免。厂商回应称质量未受影响,不包含可识别信息,并且对轻度编辑具有鲁棒性。

本文认为,无论是用户的质疑还是厂商的保证,都缺乏可验证性,而这种不可验证性才是治理的实质失效。我们将争议点按验证所需条件进行分类,并在两款开源大模型上评估公开的SynthID-Text实现,因为没有公开工具能够直接测试商业系统。实验结果显示,在普通文本上水印的影响不超过采样种子变化;在代码上,一个模型的正确率下降约三个百分点,另一个模型的影响低于测量误差,检测准确率接近随机,说明问题在可检测性而非质量。剩余的不足主要来源于访问受限或缺乏机构参与,我们将其映射为以下需求:发布对应的输出对、披露配置、进行认证审计、制定共享评估协议以及实现可互操作的检测。

点评

原文链接: https://arxiv.org/abs/2609.09604

[h] 返回首页