详情

首页手游攻略 Anthropic发文说明Claude文本水印机制

Anthropic发文说明Claude文本水印机制

佚名 2026-08-19 07:43:56

8月17日讯,据TechCrunch消息,Anthropic于本周五发布最新博客,就外界对Claude模型文本水印技术的热议作出回应。此举系为落实欧盟《人工智能法案》中关于透明度的核心要求——该法规明确要求生成式AI服务提供商部署可有效标识AI产出内容的技术机制。此前,部分用户对该水印方案表达疑虑,Business Insider援引社交平台X上的公开反馈指出,已有数十名订阅用户因担忧水印影响使用体验而选择退订。

Anthropic在博文中解释称,该水印机制依托于模型在低敏感度词汇序列中的隐式模式嵌入,全程不改变文本表层语义与格式,普通读者完全无法察觉;但经授权持有解码密钥的第三方可准确识别。公司强调,水印嵌入过程未对Claude的生成质量、逻辑连贯性或响应准确性造成任何可观测影响,并已采用Google DeepMind于2024年发布的SynthID-Text开源框架,后续将面向开发者开放水印检测API接口。

针对水印在文本编辑场景下的鲁棒性问题,Anthropic说明:常规程度的微调(如替换同义词、调整句式)难以彻底抹除水印痕迹;但若进行逐词重写或深度改写,原始水印将失效。对于仅由Claude执行语法校对、错别字修正或轻微润色的文本,水印留存概率取决于文本总长度及编辑操作的覆盖密度。在代码类输出中,由于功能正确性为首要约束,水印主要被限制应用于注释、文档字符串等非执行区域,对实际运行逻辑几乎无干扰。

此外,Anthropic透露,包括多家头部大模型厂商在内的行业参与者均已共同签署同一份自律性行为准则,承诺将依据各自技术路径陆续落地适配的水印实施方案。

相关资讯
点击查看更多
游戏推荐
推荐专题
热门阅读
推荐下载