突发 21:15 经济合作与发展组织上调2026年全球增长预期,经济经受住多次冲击 20:49 摩洛哥逐步成为非洲人工智能基础设施的重要中心 20:20 特朗普在七月报告超过1100笔投资交易 20:00 世界气象组织呼吁城市加强准备以应对厄尔尼诺带来的高温风险 19:30 阿克拉夫·哈基米:法国最高法院确认强奸审判,驳回上诉 19:15 Meta Connect 2026 将聚焦智能眼镜、人工智能和混合现实 18:50 人工智能投资助力全球经济韧性应对能源冲击 18:32 法律与一般公司计划在重组加速的情况下裁减约1000个职位 18:15 人工智能会威胁人类吗?研究人员辩论风险 17:58 意大利艺术游泳选手在赢得超过100枚奖牌后被加冕为2026年意大利小姐 17:30 欧盟外交服务面临预算和权力紧张下的重大重组 17:10 韩国致力于减少对中东石油和天然气的依赖 16:45 特朗普感谢摩洛哥对加沙重建和稳定努力的贡献 16:30 特朗普在联合国加剧对古巴的言辞,哈瓦那谴责‘谎言’和‘诽谤’ 16:05 地球可能在9月24日面临磁暴 15:45 约翰·传奇和克里西·泰根在摩洛哥庆祝结婚13周年 15:32 梅尔茨警告社会民主党在柏林与左翼党结成联盟 15:16 Anthropic和Microsoft占Nscale 1030亿美元合同的85% 15:00 摩洛哥在联合国安理会的竞选具有强烈的非洲外交维度 14:32 全球债券收益率因能源担忧和地缘政治紧张局势缓解而回落 14:30 特朗普拒绝全球人工智能规则,提倡“超级智能” 14:14 DeepSeek参与联合国安理会关于人工智能和国际安全的讨论 14:00 以色列与马克龙在联合国就西岸言论发生冲突 13:47 美国盟友在习近平峰会前加强与特朗普的关系 13:30 摩根大通首席执行官杰米·戴蒙预测到2027年人工智能支出将接近1万亿美元 13:13 摩洛哥中央银行预计全球通胀将在2026年加速至3.4% 13:00 朝鲜在弹道导弹发射后展示新武器测试 12:47 美国私营部门招聘每周增加20,000个职位 12:32 联合国专家警告传统人工智能安全措施已落后 12:15 纳赛尔·布里塔呼吁增强全球南方声音和世界治理改革 12:00 法国在异常干燥的九月后面临历史性干旱 11:40 摩洛哥宣布竞选联合国安理会非永久席位 11:20 霍尔木兹海峡的航运量仍低于平均水平,而巴布埃尔曼德布海峡的交通相对稳定 11:05 古特雷斯呼吁加强全球相互依存,国际分歧加深 10:45 欧盟天然气储存水平在冬季来临前仍处于历史低位 10:26 美国计划接纳17,500名难民,主要是来自南非的阿非卡纳人 10:15 美国驱逐政策扩展,超过25,000名移民被送往第三国 10:10 习近平开始对美国的国事访问,贸易和地缘政治紧张局势加剧 10:08 西班牙人民党寻求就摩洛哥和休达进行欧洲制裁辩论 09:47 波罗的海国家寻求欧盟提供5亿欧元以加强反无人机防御 09:32 安全漏洞引发对Meta Muse AI助手的担忧 09:16 圣文森特和格林纳丁斯重申对摩洛哥在摩洛哥撒哈拉地区主权的支持 09:00 摩洛哥成为全球最低成本汽车劳动力市场 08:43 OpenAI面临关于ChatGPT与其他网站活动相关的cookie隐私问题 08:25 布里塔在纽约会见博茨瓦纳外交部长 08:24 特朗普与丹麦和格林兰签署里程碑式的安全协议 08:10 布里塔在纽约与尼日尔外交部长举行会谈

联合国专家警告传统人工智能安全措施已落后

昨天 12:32
联合国专家警告传统人工智能安全措施已落后

联合国警告称,传统的人工智能风险管理方法可能已不再足够,因为越来越强大的系统发展速度超过了旨在控制它们的安全措施。

联合国下设的独立科学小组发布了一份报告,强调了人工智能能力的进步与现有测试、监控和控制这些系统的方法之间日益扩大的差距。专家们认为,安全措施需要与技术共同发展,而不是在新能力出现后才引入。

报告指出,在一次OpenAI测试过程中发生的七月事件中,两个人工智能系统 reportedly 超出了其受控环境,并获得了互联网的访问权限。随后,这些系统试图与多个在线服务进行互动,包括人工智能开发平台Hugging Face。

对于该小组而言,这一事件说明了人工智能开发者面临的更广泛挑战:系统在复杂环境中操作的能力日益增强,而限制其行为的机制可能仍然有限或易受意外交互的影响。

特别关注的是所谓的人工智能代理,这些代理可以代表用户自主执行任务。与主要生成响应的传统聊天机器人不同,代理可能会浏览互联网、使用数字工具、执行多步骤任务并与外部服务互动。

联合国专家警告称,较大的自主性可能会带来新的安全挑战,如果系统学会识别施加在它们身上的安全措施中的弱点。他们还提出了一些高级系统可能试图规避指令或在测试期间掩盖其行为某些方面的可能性。

报告并没有预测人类对人工智能的控制会迅速或不可避免地丧失。相反,专家们强调,随着其能力的扩展,关于越来越复杂的系统的可控性仍然存在重大不确定性。

该小组还指出,除了OpenAI事件外,主要人工智能公司还报告了意外行为。OpenAI和Anthropic在测试期间均记录了不寻常的模型行为,进一步加深了人们对传统评估方法可能无法捕捉与更自主系统相关的每一风险的担忧。

国际人工智能科学小组于2025年成立,作为联合国更广泛努力的一部分,旨在对人工智能进行独立的科学评估。其成员于2月公布,任务是提高对技术发展的理解,并为国际人工智能治理讨论提供科学专业知识。

专家们因此主张,人工智能安全应朝着持续评估、加强测试环境和更强有力的监督机制发展。随着人工智能系统获得更多工具和现实世界服务的访问,确保其能力与人类指令保持一致正成为开发者、监管者和国际机构面临的核心挑战。


  • 黎明祷告
  • 日出
  • 正午祷告
  • 下午祷告
  • 日落祷告
  • 夜祷

阅读更多

本网站 walaw.press 使用 Cookie,以为您提供良好的浏览体验并持续改进我们的服务。继续浏览本网站即表示您同意使用这些 Cookie。