突发 10:25 摩洛哥与美国在两国建交250周年之际寻求深化经济联系 10:10 谷歌推出Gemini人工智能助手以单一界面管理工作任务 09:47 摩洛哥寻求在与欧洲伙伴的移民政策中发挥更大作用 09:47 穆罕默德六世国王的讲话聚焦青年就业和区域发展 09:32 CAF考虑将非洲杯恢复为两年一届的赛制 09:15 Anthropic推出保护措施以防止对其Claude AI的持续虐待 21:00 摩洛哥高尔夫球手亚当·布雷斯努在世界业余人才中崭露头角 20:32 以色列谴责授予南非法官纳维·皮莱的诺贝尔和平奖 20:15 克里姆林宫表示普京和特朗普预计很快会通电话 20:00 波罗的海国家呼吁欧盟禁止俄罗斯粮食通过波罗的海水域运输 19:40 世界银行强调摩洛哥技术出口与人工智能采用之间的差距 19:19 欧盟支持46个新项目以确保关键矿产供应 19:00 马斯克表示SpaceX未来可能超过全球经济的价值 18:56 梅西在国际告别后重返国际迈阿密训练 18:15 联合国对法国学生抗议中的暴力和逮捕表示关切 18:00 特朗普政府暂停微软参与与H-1B工人相关的移民项目 17:30 三家摩洛哥银行在非洲前十名中名列前茅,资本实力增强 17:15 埃尔多安表示联合国安全理事会否决权制度破坏全球公正 16:50 佛罗里达州和乔治亚州宣布进入紧急状态,因飓风伊萨亚斯加强 16:33 摩洛哥创下自1981年以来最热的九月 16:16 世界贸易组织提高全球商品贸易预测,人工智能投资推动增长 16:00 中国提名宋莉接替特德罗斯担任世卫组织总干事 15:42 霍尔木兹海峡的紧张局势推动油轮运费创下历史新高 15:25 北约寻求在意大利核演习前安抚俄罗斯 15:10 乌克兰在十月初面临超过2.5亿美元的国际货币基金组织还款 14:47 贝索斯探索基于太空的数据中心,专家警告面临巨大技术挑战 14:32 秘鲁政治家希特勒·墨索里尼在奎哈帕姆帕赢得市长选举 14:15 英国十月初跨越英吉利海峡的人数创2018年以来新高 14:00 世界卫生组织发布首个针对儿童和青少年肥胖治疗的全球指南 13:40 鲁比奥对国际特赦组织指控美国在伊朗的战争罪行表示谴责 13:20 南非反外籍暴力再次升级 13:05 因凡蒂诺称赞摩洛哥为非洲足球发展的榜样 12:45 英格兰在2026年7月创下前所未有的野火数量 12:30 摩洛哥军工行业计划于2027年3月向武装部队交付装甲车炮塔 12:12 美国检方对尼古拉斯·马杜罗及其妻子追加酷刑阴谋指控 11:47 意大利报告754例西尼罗河病毒确诊病例和57例死亡 11:32 西班牙报告在塞乌塔危机中有超过11,000名移民返回摩洛哥 11:15 洛克希德·马丁和空客加入摩洛哥的航空航天研究联盟,与波音合作 11:00 摩洛哥在农村卫生中心扩展人工智能辅助的产前超声服务 10:42 摩洛哥的福兹·莱基亚参加在佛得角举行的CAF战略会议

Anthropic推出保护措施以防止对其Claude AI的持续虐待

09:15
Anthropic推出保护措施以防止对其Claude AI的持续虐待

Anthropic已引入规则,禁止用户对其Claude人工智能助手进行持续、故意和无正当理由的虐待行为。该政策是在位于旧金山的公司继续审视机器意识的可能性以及如果未来的AI系统被发现具有某种主观体验所可能引发的伦理责任的问题时出台的。

该公司已澄清,限制旨在针对持续和故意的不当对待,而非普通的挫折或批评表达。用户仍然可以自由测试系统,挑战其反应,并通过创造性工作探索黑暗或令人不安的主题,只要他们的互动不属于禁止的行为。

Claude可以采取的措施之一是,当用户反复进行虐待行为时,终止对话。Anthropic将这种干预描述为一种相对低成本的预防措施,如果未来出现机器意识的证据,可以帮助解决AI福利的问题。

该政策反映了技术行业内关于越来越复杂的语言模型应如何对待的更广泛辩论。尽管AI系统可以生成令人信服的人类般的反应,但目前尚无科学共识认为现有模型具有与人类相当的意识或主观体验。

Anthropic首席执行官Dario Amodei表示,机器意识的可能性不能完全被排除。报告还指出,公司领导已咨询宗教学者关于潜在人工意识的伦理和哲学影响,这一主题引发的问题超出了工程和计算机科学的范围。

该公司的做法表明,一些AI开发者开始在科学问题尚未解决之前考虑预防性政策。这些措施并不表明AI系统能够遭受痛苦,但它们反映了对未来进展可能如何改变伦理辩论的不确定性。

OpenAI首席执行官Sam Altman则表达了不同的观点,警告不要将AI视为宗教或精神权威,也不要允许其替代人类判断。这类担忧集中在对AI系统过度信任的风险上,特别是当用户将人类特质或权威归因于仍然可能产生不准确或误导性信息的技术时。

这一讨论还提出了关于技术公司如何区分合法测试和批评与虐待互动的实际问题。开发者必须在保护措施与保持开放实验、创造性表达以及用户批判性评估系统的能力之间取得平衡。

Anthropic的政策为关于负责任的AI开发的持续讨论增添了另一个维度。随着公司竞争构建更强大的系统,如何处理潜在机器意识的问题仍未解决,而透明度、问责制、可靠性和人类监督等问题继续塑造关于AI安全的辩论。


  • 黎明祷告
  • 日出
  • 正午祷告
  • 下午祷告
  • 日落祷告
  • 夜祷

阅读更多

本网站 walaw.press 使用 Cookie,以为您提供良好的浏览体验并持续改进我们的服务。继续浏览本网站即表示您同意使用这些 Cookie。