“隐形水印”能遏制AI生成的低质内容吗?专家持怀疑态度

作者: aeks | 发布时间: 2026-08-17 12:01 | 更新时间: 2026-08-17 12:01

学科分类: 新闻传播学 法学 计算机科学与技术

“隐形水印”能遏制AI生成的低质内容吗?专家持怀疑态度
“隐形水印”能遏制AI生成的低质内容吗?专家持怀疑态度

AI公司Anthropic(总部位于美国旧金山)宣布,自2024年8月2日起,所有新发布的Claude系列模型生成的文本,将通过算法在选词层面做细微调整,嵌入一种统计上可检测、但肉眼不可见的‘隐形水印’;该水印不影响文本原意、质量或可读性,且可能在轻微编辑后仍保留。同时,Claude生成的图像大多会附带含数字签名的元数据,表明该图由AI处理生成。这一措施主要为履行欧盟《人工智能法案》要求:自2024年8月2日起,前沿AI模型提供方必须确保其输出内容可被识别为AI生成,否则面临最高1500万欧元(约1700万美元)或全球年营业额3%的罚款;新模型须立即合规,已上市模型宽限期至12月2日。Anthropic表示水印将全球统一启用。需注意的是,水印仅提示内容‘可能由Claude参与生成’,而非确证——例如用户可能仅用Claude翻译或总结人类原创内容;反之,无水印也不代表内容非AI生成,因为极短文本、改写或重述后的文本可能丢失水印信号。专家指出,水印易被其他AI工具擦除(如所谓‘人类化’工具),难以阻止刻意造假者生产低质‘AI垃圾论文’;但若配合可靠检测工具(Anthropic承诺开放此类工具),并控制误报率,仍有助于期刊和会议落实‘禁用AI’政策。例如,2026年国际机器学习大会(ICML)在同行评审环节对送审稿件添加水印,一旦评审报告中出现水印特征文本即视为违规,最终发现506名评审员违反规定——这说明多数违规行为并非精心规避,而是直接复制粘贴AI输出。

DOI: 10.1038/d41586-026-02503-7

标签: AI水印 AI生成内容识别 Claude模型 学术诚信 欧盟人工智能法案