突发 13:45 前OpenAI研究人员警告人类无法理解的AI系统 13:30 ChatGPT、Claude和Gemini会被欺骗吗?新的恐怖主义测试揭示了AI的安全盲点 13:15 特朗普宣布进一步措施应对柴油价格上涨 13:00 摩洛哥女足在拉巴特以3-1战胜乌兹别克斯坦 12:32 巴西在总统决选前两周削减燃料税 12:15 土耳其禁止社交媒体服务向15岁以下儿童提供 11:50 特朗普批评诺贝尔和平奖决定并质疑其可信度 11:32 法国媒体机构因Meta的在线广告行为寻求14亿欧元赔偿 11:15 世界气象组织警告到2026年底可能出现创纪录的厄尔尼诺现象 11:00 世卫组织呼吁各国扩大社区精神卫生服务 11:00 阿联酋检察官称Flydubai副驾驶涉嫌策划自杀式袭击特拉维夫机场 10:42 摩洛哥的发展议程从重大成就转向可衡量的社会影响 10:25 摩洛哥与美国在两国建交250周年之际寻求深化经济联系 10:10 谷歌推出Gemini人工智能助手以单一界面管理工作任务 09:47 摩洛哥寻求在与欧洲伙伴的移民政策中发挥更大作用 09:47 穆罕默德六世国王的讲话聚焦青年就业和区域发展 09:32 CAF考虑将非洲杯恢复为两年一届的赛制 09:15 Anthropic推出保护措施以防止对其Claude AI的持续虐待 21:00 摩洛哥高尔夫球手亚当·布雷斯努在世界业余人才中崭露头角 20:32 以色列谴责授予南非法官纳维·皮莱的诺贝尔和平奖 20:15 克里姆林宫表示普京和特朗普预计很快会通电话 20:00 波罗的海国家呼吁欧盟禁止俄罗斯粮食通过波罗的海水域运输 19:40 世界银行强调摩洛哥技术出口与人工智能采用之间的差距 19:19 欧盟支持46个新项目以确保关键矿产供应 19:00 马斯克表示SpaceX未来可能超过全球经济的价值 18:56 梅西在国际告别后重返国际迈阿密训练 18:15 联合国对法国学生抗议中的暴力和逮捕表示关切 18:00 特朗普政府暂停微软参与与H-1B工人相关的移民项目 17:30 三家摩洛哥银行在非洲前十名中名列前茅,资本实力增强 17:15 埃尔多安表示联合国安全理事会否决权制度破坏全球公正 16:50 佛罗里达州和乔治亚州宣布进入紧急状态,因飓风伊萨亚斯加强 16:33 摩洛哥创下自1981年以来最热的九月 16:16 世界贸易组织提高全球商品贸易预测,人工智能投资推动增长 16:00 中国提名宋莉接替特德罗斯担任世卫组织总干事 15:42 霍尔木兹海峡的紧张局势推动油轮运费创下历史新高 15:25 北约寻求在意大利核演习前安抚俄罗斯 15:10 乌克兰在十月初面临超过2.5亿美元的国际货币基金组织还款 14:47 贝索斯探索基于太空的数据中心,专家警告面临巨大技术挑战 14:32 秘鲁政治家希特勒·墨索里尼在奎哈帕姆帕赢得市长选举 14:15 英国十月初跨越英吉利海峡的人数创2018年以来新高 14:00 世界卫生组织发布首个针对儿童和青少年肥胖治疗的全球指南

人智公司呼籲全球人工智慧協調,防止對先進系統失控

星期日 07 六月 2026 - 11:43
人智公司呼籲全球人工智慧協調,防止對先進系統失控

人智公司呼籲領先的人工智慧公司建立一個協調機制,以便在必要時暫停先進人工智慧模型的開發。該公司警告稱,人工智慧技術的快速發展可能超出人類的控制能力。

開發了聊天機器人Claude的公司週四在一篇部落格文章中表示,隨著尖端人工智慧執行任務的速度越來越快,「世界應該可以選擇減緩或暫時停止」其發展。

人智公司表示,其內部研究機構計劃與其他機構合作探討此問題,並「採取行動」協助建立可信賴的減緩或暫停機制,但並未透露更多細節。

人智公司的競爭對手OpenAI在周三發布的一份報告中提出了不同的觀點,稱“最終必須由民主政府——而不是單獨行動的私營公司——來決定規則、保障措施和問責機制。”

「我們認為,人工智慧創新速度的決策不應由任何一個實驗室、公司或特殊利益團體決定,」該公司表示。

Anthropic 在部落格文章中指出,人工智慧模型的運作速度正在不斷提升,它們自主執行軟體任務(例如編寫程式碼)的速度也在迅速提高。根據目前的趨勢,如果擁有足夠的運算能力,人工智慧系統或許能夠設計和開發出自己的後續版本,這被稱為「遞歸式自我改進」。

Anthropic 表示,自建置人工智慧將是一項重要的技術里程碑,它將為科學、醫療保健和其他領域帶來益處,但「它也可能增加人類失去對人工智慧系統控制權的風險」。

一些科技業人士長期以來一直警告會出現這種情況。

Anthropic 的部落格文章發布之前,多倫多大學的一個研究團隊本周也發出了類似的警告。該團隊展示瞭如何利用人工智慧工具創建一種新型的人工智慧“蠕蟲”,這種蠕蟲會在設備間傳播的過程中不斷調整其攻擊策略,最終控制龐大的計算網路。

「我認為,人們必須明白,並非只有規模最大、功能最強大的語言模型才會引發安全隱患,」首席研究員尼古拉斯·帕珀諾特在一次採訪中表示。

Anthropic公司聯合創始人傑克克拉克和其研究機構負責人瑪麗娜法瓦羅在這篇部落格文章中表示,這次暫停是為了讓「社會結構和協調研究」能夠跟上人工智慧發展的步伐。 「協調」是業界對確保科技符合人類價值和意圖的簡稱。

擬議的協調機制將使先進的人工智慧實驗室能夠驗證全球競爭對手是否真的停止或放緩了研發工作,「從而防止惡意行為者利用這種協調一致的放緩策略秘密搶佔先機」。

該公司表示,需要一個協調一致的全球機制,因為如果沒有這樣的機制,人工智慧發展的放緩可能會讓「最不謹慎」的參與者迎頭趕上,並給企業和政府在人工智慧安全方面做出艱難抉擇時帶來更大的壓力。

Anthropic發布此消息之際,該公司正與ChatGPT的開發商OpenAI競相上市,此次IPO可能會讓Anthropic的估值接近一兆美元。

Papernot在發布報告前已通知加拿大網路安全部門。該報告揭示了研究人員如何在實驗室中使用一款「開源」人工智慧工具開發出這種蠕蟲病毒,軟體開發人員可以輕鬆廉價地存取和修改該工具。

“過去,網路攻擊者會專注於高價值目標,”他說道,“例如銀行系統、醫院、電網、水處理系統和學校。”

Papernot也認為,隨著人工智慧驅動的駭客工具大大加速了電腦漏洞的搜索,企業、政府機構和學術研究人員之間應該加強合作,共同開發應對措施。

「你放在地下室裡那台不常查看的舊筆記型電腦看起來似乎不是什麼高價值目標,但它卻可以成為攻擊這些高價值目標的跳板,」他說。 “由於網路攻擊的成本已大幅降低,任何連接到互聯網的設備都面臨風險。”

 


  • 黎明祷告
  • 日出
  • 正午祷告
  • 下午祷告
  • 日落祷告
  • 夜祷

阅读更多

本网站 walaw.press 使用 Cookie,以为您提供良好的浏览体验并持续改进我们的服务。继续浏览本网站即表示您同意使用这些 Cookie。