Anthropic通过隐形水印加强Claude生成文本的识别
Anthropic推出了一项新机制,以便于识别其人工智能模型生成的内容。从2026年8月2日起,Claude的新版本可以直接在生成的文本中集成隐形水印,这一进展旨在满足欧盟关于人工智能的透明度要求。
与传统标记不同,该过程不会明显改变提供给用户的回答。水印在文本生成的同时集成,并应通过检测系统估计内容是否可能由Claude生成。
集成在生成中的标记
Anthropic采用的技术基于SynthID-Text,由Google DeepMind开发。其原理是在单词选择过程中进行干预:模型根据一个秘密密钥遵循特定的序列,从而允许在文本中查找标记的存在。
Anthropic将这种方法视为一种不需要在回答中添加可见标记或符号的可追溯机制。该公司还声称,这种方法不会降低生成文本的质量。
Google DeepMind之前在大约2000万条由Gemini生成的回答中实验了SynthID-Text。根据公司发布的结果,这次实验并未显示用户满意度有可测量的下降。
检测工具,而非识别工具
然而,水印不应被视为查找内容创作者或用户的手段。
正面的检测可能表明文本具有与Claude生成相符的特征,但该机制无法识别使用该模型的账户或个人。
这一区分在教育、媒体和企业等领域越来越多地使用AI生成内容检测工具的背景下显得尤为重要。
面对转化文本的局限性
此外,该系统并非万无一失。非常短的文本可能会使检测变得更加困难。对于混合内容,即人类写作与自动生成相结合的内容,或经过重大重写的文本也是如此。
通过另一种人工智能模型进行的新转化也可能足够改变内容,从而影响水印的追踪能力。
因此,这种方法与传统的AI检测器有所不同,后者通常试图识别可能区分人类创作与自动生成文本的统计特征。这些工具可能会导致分类错误。
Anthropic正在准备一个验证工具
Anthropic还计划提供一个专门用于水印验证的API。该接口将允许服务或开发者在提交分析的内容中查找标记的存在。
不过,该公司尚未说明该API何时可以访问。
通过这一机制,Anthropic旨在在Claude生成的内容周围引入额外的透明度,同时保持对用户的隐形标记。随着对生成的人工智能内容透明度要求的加强,这项技术可能会变得越来越重要。
-
12:56
-
12:47
-
12:29
-
11:53
-
11:15
-
11:01
-
10:24
-
10:11
-
10:04
-
09:53
-
09:40
-
09:30
-
09:28
-
09:19
-
09:03
-
08:55
-
08:51
-
08:46
-
08:45
-
08:42
-
08:37
-
08:36
-
08:36
-
08:09
-
08:07
-
08:05
-
22:38
-
21:31
-
21:11
-
21:05
-
20:01
-
19:49
-
19:36
-
18:45
-
18:22
-
17:20
-
17:00
-
16:44
-
16:25
-
16:23
-
16:16
-
16:16
-
16:06
-
15:45
-
15:30
-
15:15
-
15:15
-
15:05
-
14:46
-
14:43
-
14:30