}

当地时间11日,美国Anthropic公司官网宣布,给其标志性大模型Claude输出的每个文字都盖了“隐形章”,用于识别检测该段文字的出处。


▲坐落在美国加州旧金山的Anthropic大楼 图据ICphoto

该公司称,这是根据欧盟《人工智能法案》关于人工智能生成内容透明度的行为准则所作出的承诺。8月起,这家AI公司就已开始为全球所有新版Claude模型生成的文本嵌入机器可读的水印。

不过,Anthropic公司坦承,该“盖章系统”的精确度无法保证,如果检测到水印并不一定等于AI代写,检测不到水印也不等于是人类原创的文字。

这次变动的直接推手是欧盟《人工智能法案》第50条。该条款8月2日正式生效,要求生成式AI提供商必须对AI输出内容做出机器可读的标记,违规最高可罚1500万欧元或全球年营业额的3%。

Anthropic公司签署了配套的《AI生成内容透明度行为准则》,这份准则目前已有约190家机构签署,包括Google、Meta、Microsoft、OpenAI等。

虽然是欧盟颁布的《人工智能法案》,但Anthropic选择全球统一执行,而不是只在欧盟区“应付差事”。公司官网宣称:“无论你走到哪里,无论你使用的是哪一个代际的Claude产品,文本水印都会跟随。”

该水印系统没有opt-out选项,即使是充值很多的“VIP用户”也无法得到豁免。

Claude为自身AI模型输出的内容,打上了统计学概率水印。不论你是直接复制粘贴、截图后使用OCR识别,还是对着屏幕用笔抄写后再手工打字输入,只要文字内容没有变,隐藏在词汇组合中的统计学标记(水印)就依然存在。不过,AI生成的图像就不那么好“防伪”了,通过截图等方式,可以破坏其元数据标签从而去除水印。

在全球主流大模型公司里,这是第一次有人在文本层面大规模落地“概率指纹”水印。该公司计划后续发布检测工具,供用户和第三方查验。

不过,该公司也列出了目前水印系统的局限。

首先,用户可能只是用Claude校对、翻译、摘要或排版,底层内容完全是用户自己写的,输出的文本也照样带水印。

另外,这套“防伪系统”其实也有破解的招数。文本经过大规模改写、翻译、重述后,水印大概率会被破坏;同时,如果段落太短则无法得到可靠检测结果。

用户还可以让其他家大模型改写Claude生成的内容,以混淆其独有的特征。

红星新闻记者 郑直

编辑 邓旆光

审核 冯玲玲