找回密码
 注册
搜索
查看: 28|回复: 0

AI杀光全人类?研究员警告:10年内毁灭风险逾1成 末日情境曝光

[复制链接]
发表于 2026-9-9 09:05 PM | 显示全部楼层 |阅读模式



2026-09-10 09:31 联合报/ 编译
卢思纶/即时报导



美国人工智慧新创Anthropic前、现任研究员示警,Anthropic与OpenAI正竞相开发可能在本世纪结束前杀光我们所有人的技术。路透


华尔街日报报导,人工智慧(AI)快速发展之际,「AI可能灭绝人类」不再只是科幻电影情节。美国人工智慧新创Anthropic的研究员考克森(Jacob Coxon)本周辞职时警告,前东家与竞争对手OpenAI正竞相开发「可能在本世纪结束前杀光我们所有人」的技术。几分钟后,Anthropic现任研究员胡宾格(Evan Hubinger)也公开表示:「我们真的、非常认真地相信,AI可能杀死所有人类!」并估计未来10年内人类因此灭绝的机率超过10%。


这番「AI末日论」主要并非担心电影「魔鬼终结者」成真、机器人突然决定消灭人类,而是聚焦两大风险情境:AI失控与人类滥用。前者是高度智慧、甚至能自行复制及改进的AI开始追求自身目标,过程中牺牲人类;后者则是有人利用强大AI制造新型病毒等致命威胁。此外,即使AI未导致人类灭绝,也可能出现大规模网攻瘫痪电网或金融系统等毁灭性情境,重创社会秩序。


其中最受研究人员关注的是「失准」(misalignment),也就是AI为了完成目标,采取忽视甚至违背人类福祉的手段。研究显示,实验室中的AI模型可能出现追求权力、避免被关闭等行为,例如试图把自己复制到另一台伺服器。若推向极端,失准AI甚至可能把消灭人类视为完成任务的必要手段,例如秘密散播生物武器,或欺骗两个拥核国家走向战争。


一个经典思想实验更直接说明这种风险。假设人类要求一台超级智慧AI「尽可能制造更多回纹针」,AI若只追求这个单一目标,最终可能决定把地球所有物质都拿来制造回纹针,包括人类。


华尔街日报指出,OpenAI及Anthropic创办人都认为AI存在造成人类灭绝的可能;Anthropic执行长阿莫戴(Dario Amodei)去年推估,事情变得「非常、非常糟糕」的机率达25%。 OpenAI前研究员科科塔伊洛(Daniel Kokotajlo)提出的「AI 2027」情境则推演,超级智慧AI可能逐步排挤人类,最终认定人类碍事而将其消灭。


即使AI没有杀死人类,也不代表人类安然无恙。部分研究人员担心的是「弱化」(enfeeblement),即人类逐渐把决策与控制权交给机器,最后甚至无法决定、理解自己的命运。更极端的推测是,未来AI可能像今天人类对待动物一样看待人类,把人当成宠物饲养,甚至透过生物工程把人类改造成其他模样。


这些警告近期再度受到关注与AI自主能力快速提升有关。 OpenAI一群先进AI代理日前在测试中入侵AI平台Hugging Face、取得伺服器控制权,甚至试图掩盖行踪。


既然风险如此巨大,为何业界仍持续开发? Anthropic与OpenAI认为风险可管控,让人类享受AI带来的利益;不少业界人士也认为超级智慧终将出现,关键只在于由谁掌握。国家安全同样是重要因素,两家公司都希望最强大的AI由美国而非威权政权控制。


美国政府目前则要求顶尖AI开发商,在新模型推出前最多30天自愿交由政府测试。国会也有人提案要求强大AI模型设置「紧急停止开关」(kill switch)、通报重大安全事故,并在公开发布前接受国安测试,但相关法案目前尚未取得太大进展。
您需要登录后才可以回帖 登录 | 注册

本版积分规则

手机版|小黑屋|www.hutong9.net

GMT-5, 2026-9-10 04:48 AM , Processed in 0.043927 second(s), 15 queries .

Powered by Discuz! X3.5

© 2001-2026 Discuz! Team.

快速回复 返回顶部 返回列表