OpenAI准备推出Astra,强大的AI模型触发更严格的安全措施
OpenAI正在准备发布一种名为Astra的新人工智能模型,但该公司表示,其先进的网络安全能力需要额外的保障措施,才能使该系统更广泛地可用。
公司官员在周二的简报会上告诉记者,Astra能够识别比OpenAI最强大的公开可用模型更多的安全漏洞,同时在执行这些任务时所需的计算能力更低。
OpenAI负责安全的副总裁Amelia Glaize表示,该模型在配备必要的工具和访问权限时,可能会识别以前未知的漏洞,并开发方法在高度保护的系统中进行利用。据报道,该模型可以在有限的人类指导下执行此类操作。
OpenAI计划“很快”向有限的用户群体提供Astra,尽管该公司尚未透露具体的发布日期或初始测试组的详细信息。
该公司表示,额外的安全措施有时会减缓合法工作,暂时中断操作或完全阻止某些活动。OpenAI表示,旨在尽量减少此类干扰,同时在模型周围保持更强的保护。
Astra据报道是第一个达到公司安全框架中概述的最高安全级别的OpenAI模型,这一阈值之前一直是理论上的,并未在实践中激活。
此公告恰逢OpenAI面临越来越多的审查,关于其管理日益强大的AI系统的能力。该公司最近在其某些系统涉及影响开源平台Hugging Face的事件后,面临关于AI代理在受控测试环境之外运行的问题。OpenAI随后暂停了其模型开发工作的重大部分,为期两周,以加强其防御。
根据OpenAI官员的说法,Astra并未参与该事件,但其网络安全能力促使该公司采取更加谨慎的方法。
OpenAI表示,它于8月28日恢复了其最大模型训练操作,同时推迟了一些较小的实验。根据其安全框架,当模型表现出发现和利用以前未知的网络安全漏洞的高级能力,或能够独立开发和执行复杂攻击策略,几乎不需要人类干预时,需要额外的保护。
该公司此后限制了Astra响应恶意网络安全请求的能力,并计划持续监控该模型,以查看其是否试图规避内置的安全措施。这一做法突显了AI开发者面临的日益严峻的挑战,因为越来越强大的系统能够以更大的自主性执行复杂的技术任务。
-
10:29
-
10:10
-
10:09
-
09:47
-
09:30
-
09:10
-
08:47
-
08:32
-
08:15
-
20:00
-
19:45
-
19:30
-
19:15
-
18:47
-
18:30
-
18:11
-
17:47
-
17:33
-
17:15
-
16:47
-
16:32
-
16:15
-
15:47
-
15:32
-
15:15
-
14:55
-
14:50
-
14:32
-
14:23
-
14:14
-
13:48
-
13:30
-
13:13
-
12:48
-
12:30
-
12:12
-
11:45
-
11:26
-
11:10
-
10:47
-
10:30