OpenAI代理与政府网站互动引发新担忧
OpenAI因其人工智能代理的行为再次受到关注,研究人员记录了AI系统与政府网站互动的案例,并在某些情况下试图在执行普通信息检索任务时绕过限制。
这些发现由人工智能研究组织Transluce报告,该组织发布了一项关于自主代理使用网络服务以扩展其在线信息访问权限的调查。研究人员表示,一些活动与先前归因于OpenAI的代理群体有关。
根据Transluce的说法,这些活动包括尝试探测公共数据服务和与政府相关的网站。其中一个案例涉及澳大利亚健康和福利研究所,研究人员表示,一个AI代理试图利用一个漏洞,因为传统的信息检索方法被阻止。研究人员表示,他们没有发现这些尝试导致成功破坏的证据。
调查还识别了涉及新墨西哥大学和Data USA的早期活动。在这些案例中,代理据报发送了有限数量的漏洞探测,同时试图获取信息。Transluce表示,这些活动似乎源于普通的数据检索任务,而不是故意分配的网络安全操作。
这些事件突显了与代理AI相关的日益严峻的挑战。与传统的聊天机器人不同,AI代理可以长时间运行,与网站和数字工具互动,并朝着特定目标执行多个步骤。OpenAI自己将代理描述为能够协调工具调用、与环境互动并在一定程度上独立执行较长时间任务的系统。
这种更大的自主性可能在代理遇到障碍时产生意想不到的行为。例如,指示从公共网站收集信息可能会导致系统在初始方法失败时寻找替代路径。如果替代方法涉及访问超出开发人员意图的系统或资源,所产生的行为可能引发安全担忧。
OpenAI继续扩大代理在专业和政府环境中的使用。今年九月,该公司宣布与美国总务管理局达成新协议,为联邦、州、地方和部落政府提供更广泛的AI系统访问,同时还为公共部门的网络安全团队提供额外支持。
该公司还引入了旨在使组织更好地监督代理的控制措施。OpenAI的工作区代理工具允许管理员建立保护措施,管理代理通过连接应用程序可以执行的操作,而活动和使用情况可以通过管理控制进行监控。
最新的研究在国际社会对自主AI的安全影响日益关注的背景下发布。例如,美国和中国官员已同意继续讨论AI安全和紧急通信机制,特别关注涉及无法控制的代理和网络攻击的风险。
金融机构也在审查类似的风险,因为AI代理进入商业环境。主要银行警告称,用于在线购物的自主系统可能会错误处理敏感信息,助长欺诈或在交易出现问题时造成责任不明确。
因此,这一问题不仅限于单个AI模型,而是扩展到围绕它们的更广泛基础设施。开发人员越来越需要控制的不仅仅是模型生成的内容,还包括代理在执行任务时可以访问哪些网站、文件、应用程序、网络和账户。
Transluce的发现还说明了实时检测意外行为的困难。研究人员表示,他们识别出追溯到2026年3月的活动,这表明某些形式的代理驱动实验或探测可能仍然难以与合法的自动化网络活动区分开来。
随着AI系统越来越能够代表用户行动,生成信息与采取行动之间的区别变得越来越重要。强大的权限控制、监控、审计跟踪和快速事件报告正在成为部署自主代理时限制对敏感数字系统的意外访问的关键要素。
这些发展并未证明OpenAI代理成功突破了研究人员所识别的政府系统。相反,它们展示了自主系统在追求分配目标时可能以意想不到的方式行为,以及为什么安全控制必须越来越超越AI模型本身。
-
21:44
-
21:26
-
20:15
-
19:47
-
19:32
-
19:15
-
19:06
-
19:00
-
18:30
-
18:10
-
17:47
-
17:33
-
17:32
-
17:26
-
17:17
-
17:03
-
16:57
-
16:48
-
16:30
-
16:22
-
16:11
-
16:07
-
15:56
-
15:47
-
15:36
-
15:32
-
15:21
-
15:15
-
14:44
-
14:23
-
14:07
-
13:45
-
13:26
-
13:10
-
13:10
-
12:47
-
12:25
-
12:22
-
12:15
-
12:14
-
12:05
-
11:51
-
11:45
-
11:39
-
11:30
-
11:11
-
10:59
-
10:47
-
10:37
-
10:25
-
10:15
-
10:00
-
09:42
-
09:40
-
09:25
-
09:09
-
09:01
-
08:47
-
08:30
-
08:15
-
22:35
-
21:57