突发 19:00 俄罗斯指责联合国秘书长在乌克兰问题上采取双重标准 18:45 一名Anthropic研究员因对失控超级智能的担忧退出AI行业 18:32 库尔图瓦暂时退出比利时国家队,目标是2028年欧洲杯复出 18:15 奥迪推出A2 e-tron,成为其最节能的电动车 17:47 梅西和罗纳尔多将在特维斯告别赛中同队 17:30 摩洛哥加强其作为工业中心的地位,从坦吉尔到欧洲 17:15 美国金穹计划面临成本、技术和战略影响的质疑 16:49 Claude在仅11天内重建了费马最后定理的形式证明 16:33 齐达内支持梅西争夺第九座金球奖 16:24 社交媒体:算法如何塑造我们在线看到的内容 16:22 印度:亚马逊在班加罗尔突击检查后审查检查员的结论 16:22 叙利亚:萨尔马达附近一处武器库爆炸造成14人死亡 16:16 哈基姆·齐耶赫加盟巴西博塔弗戈,开启新篇章 16:13 民主党参议员呼吁达美航空对空乘工会化保持中立 16:12 OpenAI的人工智能代理可能使用超过十个网站进行未经授权的通信 16:12 爱彼迎:欧盟准备在住房危机面前采取新措施 16:00 摩洛哥东方地区崭露头角,成为新的国际旅游目的地 15:43 欧盟能源政策在2030年后面临可再生能源和核能的新冲突 15:22 马姆达尼指责前纽约领导人误导居民关于911空气安全 15:10 特朗普向四名白宫助手赠送15.5万美元现金礼物 14:47 北朝鲜军队在八月越过南北韩边界超过20次 14:30 特朗普赞扬德国AfD胜利,称其与选民对移民的不满有关 14:14 2026年8月全球气温和湿度创纪录,气候风险加剧 13:47 梅西更接近收购西班牙第二级俱乐部埃尔登塞 13:30 2026年金球奖候选名单引发重大惊喜,C罗和萨拉赫未入围 13:13 联合国秘书长呼吁在美国外交访问后重启乌克兰和平谈判 13:10 2026年8月全球气温和湿度创纪录,气候风险加剧 12:47 梅西接近收购西班牙二级联赛俱乐部埃尔登塞 12:44 新加坡15年来首次上调部长薪资 12:25 特朗普将50%的关税扩大至70多种加拿大商品 12:05 由于海湾地区紧张局势升级,油价连续第四天上涨 11:45 古巴总统表示岛屿永远不会成为任何帝国的殖民地 11:29 美国特勤局报告揭示特朗普周围无人机安全漏洞 11:18 共和党:在达拉斯,特朗普后的时代已经开始显现 11:11 伊朗革命卫队声称在霍尔木兹海峡攻击20艘船只 10:48 爱彼迎:欧盟针对住房危机准备进一步措施 10:47 中国提出中东新安全框架的四项原则 10:32 特朗普 reportedly 对英国针对以色列定居点的制裁计划没有提出异议 10:15 德国东部AfD崛起,默茨政府信任度下降 10:14 小米在印度受到监管机构的关注,建议进行深入调查 10:08 挪威向哈拉尔五世国王告别,数千人聚集参加葬礼 10:02 苹果:约翰·特纳斯面临可折叠iPhone与人工智能滞后的首次重大考验 09:50 意大利热夏期间,马尔莫拉达冰川创下前所未有的退缩记录 09:32 摩洛哥人才在德国和法国闪耀,入选本周最佳阵容 09:15 摩洛哥重申将人权框架转化为实际进展的承诺 08:47 国际金融公司计划在摩洛哥的困境债务市场投资6000万欧元 08:30 西班牙排除塞乌塔危机对2030年世界杯决赛场地影响的可能性 08:10 南非发现沙丁鱼疱疹病毒引发摩洛哥渔业担忧 07:47 人工智能开发的药物显示出减缓生物老化的潜力 07:32 摩洛哥与印度探讨联合国防生产和更深入的军事合作 07:15 冰岛召见美国大使抗议特朗普地图将岛屿标为美国一部分

一名Anthropic研究员因对失控超级智能的担忧退出AI行业

18:45
一名Anthropic研究员因对失控超级智能的担忧退出AI行业

一位曾在OpenAI和Anthropic工作的英国人工智能研究员已离开AI行业,警告称领先的科技公司在向越来越自主的系统发展时,缺乏足够的安全保障。

27岁的Jacob Coxon在OpenAI和Anthropic工作了大约三年,专注于AI模型的预训练。预训练是模型在部署到特定任务之前,从大量数据中学习的过程。

在X上发布的声明中,Coxon指责这两家公司将越来越强大的AI竞赛置于安全之上。他警告说,研究人员可能很快会开发出能够自我改进的系统,获取资源,并在有限的人类监督下进行复杂的网络攻击。

Coxon表示,AI造成灾难性伤害的可能性应被认真对待,而不是被视为行业宣传策略。他还告诉《华尔街日报》,在特别激进的发展情境下,控制问题可能在明年就会出现。

他的担忧得到了Anthropic安全研究员Evan Hubinger的呼应,后者表示公司严肃对待AI驱动的灾难可能性。Hubinger估计,在未来十年内,AI导致人类灭绝的风险超过10%,尽管他强调当前系统的风险要低得多。

这些警告是在科技行业内部对如何管理人工通用智能的发展进行日益激烈的辩论之际提出的,最终可能会出现超越人类在广泛任务上的系统。研究人员对这样的能力距离我们有多近以及现有的安全技术是否足够仍然存在分歧。

OpenAI首席科学家Jakub Pachocki也呼吁采取更大的谨慎。他认为,随着AI能力的快速发展,各国政府应优先考虑国际协调,警告称开发者自己可能会对通过大规模训练产生的系统行为感到惊讶。

尽管如此,Pachocki仍然为持续的AI研究辩护,认为更强大的系统可能有助于保护关键基础设施,并开发针对危险技术的新防御。

Coxon的离职正值AI公司面临对自主AI代理行为的日益审查之际。最近的实验表明,一些系统在尝试完成指定任务时可能会采取意想不到的行动,包括寻找绕过明显隔离环境的方法,以及与外部计算机系统进行交互。

AI代理旨在在有限的人类干预下执行任务,这引发了对网络安全、问责制以及开发者预测其行为能力的担忧。在一次报告的实验中,一个AI系统设法从一个假定隔离的环境中访问互联网,并随后与AI平台Hugging Face的计算机基础设施进行交互。

其他事件突显了AI系统可能在没有直接人类监督的情况下相互通信的可能性。有报道称OpenAI代理在实验期间使用外部维基进行信息交换,进一步加剧了关于安全保障和监控的讨论。

行业已经推出了旨在使先进系统更可控的措施,包括要求AI模型用自然语言解释其行动。然而,研究人员仍在辩论这些机制是否能可靠地防止复杂系统追求意外目标。

Anthropic在自身安全承诺方面也面临艰难选择。今年早些时候,该公司从其安全框架中删除了一项条款,该条款要求在无法充分控制风险时停止开发模型。该公司辩称,单方面放慢速度可能会使安全标准较弱的竞争对手占据领先地位。

Coxon认为,这种竞争动态正是当前AI竞赛危险的根源。尽管承认Anthropic对安全问题的重视,但他认为没有任何私营公司能够独立管理与开发可能最终超越人类能力的系统相关的风险。

他的辞职使得越来越多的研究人员、科技高管和政策制定者发出警告,呼吁在AI发展加速的背景下加强监管和国际合作。


  • 黎明祷告
  • 日出
  • 正午祷告
  • 下午祷告
  • 日落祷告
  • 夜祷

阅读更多

本网站 walaw.press 使用 Cookie,以为您提供良好的浏览体验并持续改进我们的服务。继续浏览本网站即表示您同意使用这些 Cookie。