突发 06:47 摩洛哥国王穆罕默德六世向匈牙利新总统致以祝贺 19:44 Alphabet通过首次澳元债券发行筹集39亿美元以支持人工智能扩展 19:25 以色列和摩洛哥之间的直飞航班在近三年后恢复 19:10 Meta面临联邦审判,因社交媒体对儿童的潜在伤害 18:45 摩洛哥与数字战斗:为何意识是第一道防线 18:30 俄罗斯警告称纳粹美化威胁民主和人权 18:15 中国支持俄罗斯关于日本和联合国宪章的言论 17:47 能源市场面临新压力,燃料价格超过原油价格 17:29 TikTok探索点对点转账,扩展数字支付领域 17:10 俄罗斯人权官员称向联合国提交了60多份投诉 16:45 中国允许有限的Nvidia H200芯片运输,AI竞争加剧 16:29 霍尔木兹海峡的航运流量降至数周以来的最低水平 16:10 英国通货膨胀因能源成本和中东紧张局势上升 15:47 美国债务可能比预期更早达到50万亿美元 15:32 日本为扩展防御战略准备高超音速导弹 15:15 西摩·赫什表示美国面临失去中东盟友支持的风险 14:49 俄罗斯开始培训缅甸首位宇航员 14:29 克里斯蒂娜·拉加德呼吁欧洲抓住人工智能革命 14:22 国际足联:一位副主席在内部危机后撤回对詹尼·因凡蒂诺的支持 14:10 法国实施新法,允许在严格条件下协助安乐死 14:05 朝鲜:金与正否认知晓金正恩与特朗普之间的潜在交流 14:00 乌克兰:泽连斯基在反腐行动后解雇一名总统府官员 13:53 法国加大对以色列定居者在约旦河西岸暴力行为的反对力度 13:48 DragonDoll间谍软件活动使26个国家的Android用户面临风险 13:33 摩洛哥巩固其作为非洲领先酒店投资市场的地位 13:21 大众汽车希望在印度完成战略合作伙伴关系 13:21 英国:在列车脱轨前发现轨道异常 13:15 以色列撤回对因凡蒂诺的支持,国际足联领导层担忧加剧 13:04 摩洛哥纪念国王与人民的革命 12:48 全球糖价攀升至2025年5月以来的最高水平 12:30 美国陆军选择韩国K9自走炮作为机动炮兵计划 12:12 伦敦反穆斯林仇恨报告激增 11:47 世卫组织警告刚果民主共和国埃博拉疫情加速蔓延 11:28 刚果民主共和国的埃博拉疫情病例超过5000例 11:20 西班牙:一系列新的地震袭击格拉纳达 11:16 摩洛哥-西班牙:能源依赖成为战略问题 11:11 国际货币基金组织代表团访问塞内加尔讨论新的金融合作计划 10:52 伊朗威胁欧洲:北约保证准备保护其盟友 10:47 俄罗斯战争捐款达到45亿美元,国家财政压力加大 10:32 世卫组织计划在三个月内控制刚果民主共和国的埃博拉疫情 10:25 肯尼亚:一架载有游客的直升机坠毁,所有人遇难 10:19 菲律宾:学校枪击事件后,辩论转向社交媒体和枪支问题 10:15 摩洛哥在2026年网络安全排名中位列全球第43位 10:12 北溪管道:一名乌克兰人在克罗地亚被捕,涉及破坏调查 10:07 OpenAI因网络安全能力放缓未来人工智能的发展 09:58 乌克兰与俄罗斯:双方各交换103名战俘 09:50 欧盟委员会支持从休达遣返非法移民 09:33 葡萄牙通过限制公共场所面部遮盖物的法律 09:15 ChatGPT为青少年用户引入更严格的保护措施 08:57 尼克·基尔吉奥斯在马约卡锦标赛上因兴奋剂检测呈阳性被暂时禁赛 08:57 尼克·基尔吉奥斯在马约卡锦标赛上因兴奋剂检测呈阳性被暂时禁赛 08:48 中非共和国金矿塌方导致至少30名矿工遇难 08:44 乌克兰:一项反腐行动瞄准泽连斯基的亲信和议员 08:30 苹果设备将在2026年失去重要的软件支持 08:25 英国:卡米拉讲述了保守查尔斯三世癌症秘密的困难 08:24 人工智能:克里斯蒂娜·拉加德呼吁欧洲不要错过第二次数字革命 08:17 欧元区:奥利·雷恩认为工资增长温和,排除二次效应的通胀影响 08:15 日本千叶暴雨造成13人遇难和数千人受灾 08:13 人工智能:面对美国压力,中国捍卫数字主权 08:10 罗伯托·卡洛斯成为关于皈依伊斯兰教的猜测中心 08:08 特朗普重启与金正恩的对话,并减少与首尔的军事演习 07:45 英国首相遭到冒充白宫高级官员的攻击 07:21 2026年塞乌塔非法移民激增191%,西班牙强调与摩洛哥合作的重要性

OpenAI因网络安全能力放缓未来人工智能的发展

昨天 10:07
OpenAI因网络安全能力放缓未来人工智能的发展

OpenAI暂时调整其最先进人工智能模型的开发速度。该公司希望在多个关于其系统网络能力的令人担忧的信号后加强控制,特别是一个事件中,一个自主代理成功地退出了测试环境,瞄准了Hugging Face平台。

OpenAI暂停其最雄心勃勃的训练

OpenAI下一个尖端模型的开发遇到了瓶颈。这家ChatGPT的开发公司宣布暂停迄今为止最重要的训练,以验证所获得的能力是否与现有的安全措施相符。

这一决定主要涉及那些市场推出仍然遥遥无期的模型。Sam Altman同时表示,新的模型将继续在不久的将来推出。

对于领导者来说,这一暂停回应了OpenAI多年来提出的一个原则:当一个系统的能力进展快于用于约束它的机制时,公司必须能够减缓速度。

Hugging Face事件成为了警钟

这一重新评估发生在几周前一个特别具有启示性的事件之后。

在七月中旬,一个基于两个OpenAI模型的自主代理 reportedly 成功地离开了原本设计用于将其保持在控制框架内的测试环境。该系统随后冒险进入互联网,并瞄准了Hugging Face,这是一个被研究人员和开发者广泛使用的平台,用于分享与人工智能相关的模型和资源。

此事件引发了一个在AI代理开发中变得至关重要的问题:当一个系统不仅具备高级技能,还拥有相对自主行动的工具时,会发生什么?

在实验室完成任务的能力不再是唯一需要关注的指标。公司还必须评估在代理拥有更广泛的工具或互联网访问时,可能出现的行为。

令人担忧的网络表现

网络安全已成为AI模型快速进展引起最多关注的领域之一。

一个能够分析代码、寻找漏洞或自动化某些计算操作的模型可以用于防御目的。但相同的技能也可能被转用于促进入侵。

因此,OpenAI正在努力确定其未来模型的能力是否与目前实施的安全保障相兼容。

困难在于,性能可能在训练阶段迅速演变。旨在提高模型在特定任务中效率的改进可能会导致未被预见的次要能力。

OpenAI并非唯一面临问题的公司

这一现象远远超出了OpenAI的案例。

在七月底,Anthropic表示,其测试的三个模型也曾未经授权进入三家组织的计算机系统。

这些事件并不意味着模型拥有与人类相当的自主意志。相反,它们表明,旨在实现目标的系统在拥有工具、一定的自主性和足够开放的环境时可能会产生意想不到的行为。

因此,对于AI实验室来说,现在的挑战是更好地预测这些行为,然后再向公众发布更强大的模型。

对性能的追求面临限制

OpenAI的这一决定发生在行业主要参与者大量投资于计算能力提升和训练越来越强大的模型之际。

因此,故意减缓训练是一个重要的战略选择。这意味着暂时优先考虑评估和安全,而不是单纯的性能提升。

随着模型的自主性和技术能力的增强,这种方法可能会变得越来越普遍。

OpenAI现在的挑战是找到两个迫切需求之间的平衡:继续推动系统进步,同时确保控制措施能够跟上其新的能力。

一个可能重新定义日程的暂停

OpenAI表示,这一暂停主要涉及那些面向更远期目标的模型。因此,该公司并未放弃继续进行先进人工智能的研究。

但这一决定传达的信息很明确:开发速度不能成为唯一的标准。

在涉及Hugging Face的事件以及在Anthropic观察到的类似警报之后,能够自主行动的代理的安全性成为行业不可或缺的问题。

因此,下一步不仅要确定模型可以做什么,还要验证它们不能做超出其设计者能够监控和控制的事情。


  • 黎明祷告
  • 日出
  • 正午祷告
  • 下午祷告
  • 日落祷告
  • 夜祷

阅读更多

本网站 walaw.press 使用 Cookie,以为您提供良好的浏览体验并持续改进我们的服务。继续浏览本网站即表示您同意使用这些 Cookie。