Anthropic引入谷歌文本水印系统,强化生成内容溯源能力

根据Beating的监测数据,Anthropic已正式确认在其Claude模型输出中应用Google DeepMind开发的SynthID-Text技术,用于为生成文本添加不可见水印。该方案不依赖零宽字符或隐蔽编码,而是通过在多个语义合理节点上对词汇选择的概率进行细微调整,使水印信号在文本中逐步累积,形成可被算法识别的统计特征。

水印设计兼顾隐蔽性与可验证性,不影响用户体验

整个过程不增加任何额外词元,对生成延迟几乎无影响,且定价策略保持不变。水印机制具备高度安全性,无法通过逆向工程反推具体使用者信息;检测结果仅能确认文本是否由Claude生成,无法揭示生成主体的身份或所属机构。尽管部分敏感用户因隐私顾虑取消订阅,但整体流失率未出现显著上升。

未来将开放检测接口,支持第三方内容验证

Anthropic表示,正筹备推出水印检测应用程序接口(API),允许个人用户及第三方机构自主验证文本来源,提升数字内容的透明度与可信度,助力构建负责任的AI生态体系。