OpenAI为欧盟推出AI生成文本的隐形水印技术
OpenAI正在准备推出一项新系统,该系统可以在不改变文本外观的情况下,使通过ChatGPT和Codex生成的某些文本在技术上可识别。该公司表示,这项被称为textGrain的技术将在未来几周逐步向欧盟的合格用户推出。
这一举措是在欧盟法规日益强调与人工智能创建或处理的内容相关的透明度的背景下进行的。OpenAI的方法并不是显示一个可见的标签,而是将统计信号直接嵌入生成的文本中,使专业的检测系统能够寻找其来源的证据。
对于普通读者来说,差异应该是不可察觉的。文本中不会附加任何警告、图标或明确声明,表明涉及了AI模型。
textGrain如何嵌入其信号
与依赖于隐藏字符或不可见空格的传统水印技术不同,textGrain在模型生成过程中进行操作。该系统微妙地影响某些词汇选择,创造出一种对人类读者仍然自然的模式,但可以被兼容的检测器识别。
这种设计旨在使信号更能抵御基本的复制和粘贴。然而,该技术并不是为了提供文档的完整历史。
成功的检测将表明文本是通过兼容的OpenAI系统生成或处理的。它不会揭示用户的身份,不会暴露提交给模型的提示,也不会确切确定最终文本中有多少是由人编辑的。
重写仍然是一个重大挑战
AI文本检测的可靠性与可用材料的数量以及原始措辞的变化程度密切相关。
根据OpenAI的测试报告,在某些条件下,对于大约400个词的段落,检测率达到了约92%。当大约10%的单词被同义词替换后,性能下降到约66%,而当比例达到25%时,检测率降至约17%。
翻译和大量的人为编辑也可能削弱可检测的模式。这意味着,未能识别水印本身不能证明文本完全是由人类撰写的。
OpenAI还承认出现误报的可能性,这是一个重要的局限性,尤其是对于可能考虑使用自动检测来评估学术、专业或其他书面材料的机构。
研究人员将优先获得访问权限
检测技术本身预计不会立即向所有人开放。OpenAI计划首先向选定的研究人员和专业组织提供访问权限,以便该系统进行进一步的测试和评估。
该公司还在考虑超越欧盟的更广泛应用。某些OpenAI API客户将能够在兼容模型上激活该功能,尽管默认情况下将保持关闭。
OpenAI还表示,计划将textGrain作为开源技术发布。这一举措可能允许独立研究人员和开发人员检查该方法,测试其稳健性,并探索AI内容可追溯性的新的应用。
欧洲AI透明框架中的新层次
textGrain的部署展示了欧盟在处理AI生成材料方面的更广泛转变。随着生成性AI越来越多地融入教育、商业、媒体和公共服务,政策制定者和技术公司正在寻找能够区分机器生成内容与传统人类写作的机制。
OpenAI的系统并没有为这一挑战提供明确的答案。当文本较短、被翻译或大幅重写时,其有效性可能会急剧下降,同时检测错误仍然是可能的。
尽管如此,该技术仍然代表了一种将AI透明度从可见标签转向直接嵌入生成内容中的技术信号的尝试。如果大规模采用,像textGrain这样的系统可能会成为用于评估数字文本来源的新兴基础设施的一部分。
-
17:00
-
16:40
-
16:20
-
16:00
-
15:42
-
15:25
-
15:15
-
15:10
-
14:45
-
14:32
-
14:15
-
14:13
-
14:05
-
14:00
-
13:42
-
13:21
-
13:20
-
13:05
-
12:45
-
12:29
-
12:12
-
11:47
-
11:32
-
11:15
-
11:00
-
10:42
-
10:25
-
10:23
-
10:17
-
10:10
-
09:47
-
09:30
-
23:00
-
22:59
-
22:42
-
22:22
-
22:00
-
21:40
-
21:20
-
21:20
-
20:45
-
20:32
-
20:20
-
20:15
-
19:50
-
19:45
-
19:40
-
19:32
-
19:20
-
19:15
-
19:15
-
19:00
-
18:47
-
18:30
-
18:10
-
18:00
-
17:45