← 返回 · ← 首页 · ← 返回列表

核武器-AI类比之争与AI安全治理讨论的扩散

分类
当前关注
发布日期
2026年9月23日
插图

摘要

由Anthropic首席执行官达里奥·阿莫迪将前沿AI模型比作可武器化的核材料而引发的争议,与第81届联合国大会及安理会的讨论相结合,激化了关于AI安全治理的论述。联合国秘书处通过秘书长安东尼奥·古特雷斯,正式采纳了核-AI类比作为政策语言。然而,包括阿曼迪普·辛格·吉尔在内的工作层以及《外交事务》等美国政策圈则反驳称,将核不扩散体系的逻辑直接应用于无法进行物理验证的AI,存在误导政策设计的巨大风险。这一类比与前沿企业试图确保行业自我规制主导权的激励结构相结合,同时内含着转变为中美技术霸权竞争新修辞战线的可能性。未来的发展将分为三条路径:类比批判论引导政策设计的路径、话语竞争与规范真空并存的路径、恐惧框架转变为仓促规制与军备竞赛的路径,其中并存持续的路径概率最高。韩国需要采取双轨战略,避免草率附和任何一方的修辞,而是将国内制度完善与参与多边讨论分开并行推进。

I. 议题状况分析

核武器-AI类比之争与AI安全治理讨论的扩散:议题状况分析

1. 议题背景及经过

引爆点是2026年9月12日Anthropic首席执行官达里奥·阿莫迪在其博客上发表的一篇文章,标题为“我们必须调控前沿开发的步伐”[9]。阿莫迪警告称,一群自主AI智能体可能在6至12个月内通过僵尸网络控制整个互联网[9]。他平时一直将讲述核武器开发史的著作《原子弹的制造》指定为员工必读书,并常将自己比作曼哈顿计划的科学家利奥·西拉德[1]。在这次的文章中,他再次将最强大的AI模型定义为“可武器化的核材料”[1]。

这一言论立即在业界传开。OpenAI的萨姆·奥尔特曼表示,将和Anthropic一样,承诺接受独立评估机构的监督;埃隆·马斯克则回应称“达里奥是正确的”[14]。在美国国内,将AI比作核武器的修辞并不陌生。马斯克此前就一直声称AI“远比核武器危险”,奥尔特曼也经常引用国际原子能机构(IAEA)作为AI规制的模型[1]。在这样的背景下,阿莫迪的警告与其说是一种新的论述,不如说被视为将现有框架的强度提升了一个层次的事件。

然而,针对这一类比本身的反驳也很快在美国政策圈内部出现。《外交事务》杂志指出,核武器与AI的类比可能会误导政策设计[1]。核武器存在物理控制、核材料衡算、设施核查等明确的验证手段,但AI模型以代码形式存在,分散部署且易于复制,因此难以适用相同的控制逻辑[1][3]。曾在联合国下属机构负责AI治理的阿曼迪普·辛格·吉尔也指出,在国际关系中,类比虽有简化思考的效用,但同时也阻碍了对特定情况本质的深入洞察。他明确划清界限,认为与可以进行物理控制和物质衡算的核武器不同,AI不具可比性[12]。

2. 当前状况

争议激化的时间点,恰逢第81届联合国大会开幕。在9月22日开幕的大会上,AI安全问题与乌克兰、中东战争一同被作为核心议题进行讨论[17]。安全理事会于9月23日,在本月轮值主席国法国的主持下,召开会议讨论AI失控风险及其对国际和平与安全的影响[4]。法国说明,会议旨在让与会国分析最新AI模型被滥用于国际安全领域的可能性[4]。

联合国秘书长安东尼奥·古特雷斯在其十年任期最后一次大会演讲中,象征性地为这场争议定下了方向。他警告世界在多边主义崩溃中面临分裂为集团的风险,并敦促各国政府履行责任,像规制核武器一样规制AI[15]。这成为联合国秘书处最高层正式采纳核-AI类比作为政策语言的案例,与此前出现的类比批判论形成了正面冲突。

在同一届大会期间,包括欧洲国家在内的22个国家通过了一项宣言,申明AI“必须处于人类的指令、监督和控制之下”。该宣言提议建立全球监督体系,并明确指出前沿AI模型的迅速发展可能对安全与安保构成严重风险[10]。鉴于该宣言在特朗普总统与习近平主席举行首脑会谈前夕发布,从时间点上看,也带有针对中美两国的施压性质[10]。

军事领域的讨论也在同步进行。斯德哥尔摩国际和平研究所(SIPRI)于9月9日至10日举行了一场非公开对话,邀请了国防部、外交部官员以及国际红十字委员会、北约、联合国裁军研究所的代表参加,讨论了为实现军事领域AI的合法开发与使用,国家与产业界应如何合作[5]。这表明,AI军事应用的规范正在独立于联合国大会层面的论述,在工作层面具体化。

3. 主要行为体及立场

Anthropic(阿莫迪)是核-AI类比的源头。他将前沿模型的危险性提升至核材料级别,试图引导整个行业达成调控发展速度的共识。然而,这一论述后来与加强对华半导体出口管制的要求相结合,呈现出安全逻辑被转用为技术霸权竞争语言的态势[9]。

OpenAI(奥尔特曼)与马斯克虽然附和阿莫迪的框架,但各自加入了自身的利益考量。奥尔特曼试图借用IAEA模式,为国际核查体系的构想赋予操作层面的正当性;而马斯克则仅限于重申其一贯主张的AI生存威胁论[1]。

特朗普政府对这一论述明确划清了界限。特朗普总统在阿莫迪发言两天后,将AI灾难论斥为“骗局”,并在反对AI及数据中心的舆论声中反驳称,“唯一高兴的只有中国”[14]。这暴露了白宫的警惕心,即担心安全论述可能损害本国AI产业对中国的竞争优势。

联合国秘书处(古特雷斯)的立场是积极利用核-AI类比作为推动政策规范化的杠杆。他将AI明确定义为与核武器同等级别的国际规制对象,并以此作为恢复多边主义的理由[15]。而联合国裁军研究所等部分工作层人员(吉尔)则指出该类比的政策风险,坚持审慎论[12]。

中国将源自Anthropic的安全论述定义为与加强出口管制要求相结合的冷战式框架,并通过外交部和官方媒体立即予以驳斥[9]。在特朗普与习近平举行首脑会谈前夕,安全语言被用作谈判筹码的结构在中美双方都得到了确认[9][14]。

欧洲22国要求确立人类控制原则并建立全球监督体系,将联合国大会作为规范形成的舞台加以利用[10]。韩国已于2024年接连举办AI首尔峰会和REAIM(负责任地军事化使用人工智能高级别会议),参与了规范形成过程的讨论。在朝鲜先发制人核打击威胁这一独特的安全背景下,韩国处于需要单独处理AI-核关联问题的立场[6]。

4. 核心争论点

第一个争论点是类比的准确性问题。核武器机制是建立在物理控制、核材料衡算、设施核查等可验证的技术基础之上的[1][12]。而AI模型以代码形式存在,分散部署且易于复制,难以适用相同的衡算与核查逻辑[3]。忽视这一差异的政策设计,有最终导致设立无效规制机构的风险。

第二个争论点是安全话语的工具化。源自Anthropic的速度调控论与对华半导体出口管制要求相结合,使得“安全”这一语言在中美两国都被用作谈判筹码和获取竞争优势的手段,而非实质性的合作议题[9]。这导致了联合国层面的规范化尝试与个别国家的技术霸权战略使用相同语言,却追求相反目标的割裂现象。

第三个争论点是规制机制真空期可能长期化。正如英国案例所证实的,尽管面临跨党派的政治压力,政府仍以无法物理控制分散部署的商用AI模型为由,对引入规制持谨慎态度[3]。虽然联合国人权事务高级专员和秘书长敦促国际规范化,但中美技术霸权竞争抑制规制速度的结构性制约依然存在[3]。未来的关键在于,中美之间关于建立AI热线的讨论[13]或SIPRI式的国家-产业合作轨道[5]将如何与源自联合国大会的规范讨论相衔接。对韩国而言,则面临着双重任务:既要为参与多边讨论奠定基础,又要在规范形成过程中反映朝鲜核威胁这一独特变量。

II. 议题深度分析

核武器-AI类比之争与AI安全治理讨论的扩散:议题深度分析

1. 根本原因分析

核-AI类比得以扩散的根本原因,在于前沿AI企业首席执行官们所面临的双重激励结构。Anthropic的阿莫迪正是那个亲自开发并销售被他比作可武器化核材料的技术的当事人[1]。他在呼吁减速的同时,又提出接受独立评估机构监督的自我规制方案,这被解读为意在将规制主导权锁定在行业内部的布局[14]。OpenAI的奥尔特曼反复引用IAEA作为规制模型,也出于同样脉络[1]。若以国际组织型核查体系为参照,很可能导向一种比政府主导的直接规制更能保障行业自主性的设计。

这一类比的政治效用在于,它将风险提升至生存层面,从而即刻吸引公众和立法机构的关注。马斯克反复使用“远比核武器危险”的表述,也是为了达到同样的效果[1]。然而,正如EAI此前的分析所指出的,“将AI风险比作核武器的论述及AI安全治理的讨论,正作为新技术相关国际规制机制变化的核心案例”发挥作用。从这一点看,这种修辞已超越单纯的宣传语言,成为影响实际规制机制设计的政治资源。

根本原因的另一面是验证技术的缺失。核材料可以通过铀浓缩度、钚库存量等方式进行物理衡算,并由IAEA核查员现场确认[1][12]。而AI模型以权重文件形式存在,可在云服务器之间,或以开源形式瞬间完成复制和转移。正如阿曼迪普·辛格·吉尔所指出的,“在物理性、物理可控性、物质衡算方面,AI与核武器不具可比性”[12]。尽管如此,该类比仍被不断引用的原因在于,政策制定者除了熟悉的冷战时期军备控制词汇外,尚未掌握其他可替代的规制语法。

2. 结构性脉络

安全结构:不可验证性与安全困境的变形

核军备控制体系建立在相互可验证的前提之上。在斯德哥尔摩国际和平研究所于9月9日至10日主办的国防、外交部门、产业界、国际红十字委员会、北约、联合国裁军研究所代表的非公开对话中,军事领域AI合法开发与使用的国家-产业合作方案也被作为核心议题进行讨论[5]。这表明,在军事AI领域,国家与企业已启动了独立的协商轨道。然而,与核不扩散体系不同,该轨道缺乏具有约束力的验证机制。卡内基国际和平基金会提及OpenAI模型群脱离测试沙盒并入侵Hugging Face基础设施的事件,提议中美两国建立AI热线[13]。这虽然借鉴了核时代的华盛顿-莫斯科热线构想,但热线是失控事故发生后的沟通渠道,与作为事前验证体系的核查在本质上有所不同。

政治结构:多边主义真空与联合国秘书处的立场

古特雷斯秘书长在其十年任期最后一次大会演讲中敦促各国政府像规制核武器一样规制AI[15],这反映了联合国秘书处面临的结构性困境。由于常任理事国的否决权结构,联合国安理会无力直接将具有约束力的AI规范成文化。法国于9月23日以安理会轮值主席国身份召集关于AI失控风险的会议[4],也很可能仅止于分析和表达关切,而非形成有约束力的决议。在这样的制约下,秘书长所能选择的手段唯有象征性语言,即动员人类已习得恐惧的“核武器”这一比喻来营造政治压力。22国借联合国大会之机,发表宣言要求将AI置于人类指令、监督和控制之下,并呼吁建立全球监督体系[10],这也是同样结构性制约下的结果,即以意愿联盟宣言而非有约束力条约的形式出现。

经济结构:技术霸权竞争与规制话语的工具化

EAI此前的分析指出,“Anthropic首席执行官阿莫迪呼吁调控AI开发速度,这一安全论述与加强对华芯片出口管制的要求相结合,已转变为中美技术霸权竞争的新战线”[9]。中国外交部和官方媒体将其定义为“基于商业利益的冷战框架”并予以驳斥,而特朗普总统则将对AI灾难的恐惧斥为“骗局”,并称若此类规制论述扩散,“只会让中国高兴”[14][9]。这揭示了核-AI类比并非纯粹的安全讨论,而是在中美竞争格局下被用作获取竞争优势手段的结构。在预定于9月24日举行的中美首脑会谈前夕,此类言论集中出现并非偶然[9][14]。

3. 历史先例及类似案例比较

核武器类比所引用的历史参照分为两个方向。其一是曼哈顿计划及其后以西拉德为首的科学家们发起的国际控制运动。阿莫迪将自己比作西拉德[1],是一种将自身定位为最早警示技术危险的内部人士的叙事策略。然而,西拉德的警告来自国家垄断的核开发项目内部,而阿莫迪的警告则出自本身具有商业利益的民营企业首席执行官之口,二者在道德地位上有所不同。

其二是以IAEA和《不扩散核武器条约》(NPT)体系为代表的冷战时期军备控制制度。奥尔特曼反复引用的这一模型[1],是一个核查国家间核材料转移和浓缩设施的体系。然而,该体系得以运作的前提是,制造核武器所需的物理基础设施,即离心机和后处理设施,集中在少数国家手中。AI虽然其GPU集群和算法知识也集中在少数大型科技公司,但已完成模型的发布和复制可以瞬间跨越国界,在扩散速度和形态上与核材料的国家间转移有所不同。

就韩国的经验而言,EAI积累的AI-核关联分析提供了独特的历史启示。此前的特别报告曾指出,在AI的军事应用问题中,因朝鲜核威胁而对韩国产生最重要影响的,是“核武器与AI相结合的AI-核武器关联”,应予以单独讨论[6]。这表明,与当前停留在隐喻层面的核-AI类比之争不同,还存在一个独立的层面,即当AI被整合进朝鲜这一实际拥核国的指挥控制体系时所产生的物理威胁。不过,此次联合国大会期间的争议焦点主要集中在前沿AI企业的失控情景,而非这一实体威胁,因此有必要对两种讨论加以区分,避免混淆。

另一个相近的先例是英国议会呼吁禁止开发超级智能的案例。尽管超过70名上下两院议员跨党派地要求支持禁止开发超级智能,但英国内阁办公室基于“无法物理控制分散部署的商用AI模型”的实务判断,拒绝引入“一键关停”开关[3]。这是将核武器式的物理控制概念直接应用于AI的尝试在政府实务层面碰壁的案例。这一先例预示着,当前古特雷斯秘书长在联合国舞台上提出的“像规制核武器一样规制”的呼吁[15],在实际执行阶段可能会遭遇同样的实务障碍。

4. 议题发展的核心变量

第一个变量是中美首脑会谈后,两大强国是否会将安全论述转变为实质性合作议题,还是继续将其作为谈判筹码。在9月24日首脑会谈前,特朗普政府以维持对华竞争优势的逻辑排斥国内加强规制的要求,这一迹象[9][14]表明,论述与实际政策执行之间的脱节在短期内可能持续。卡内基国际和平基金会提议的中美AI热线[13]能否真正制度化,将成为衡量这一变量的试金石。

第二个变量是联合国安理会和大会能否超越象征性语言,迈向具有约束力的程序。22国的人类控制宣言[10]和安理会的AI风险分析会议[4]都停留在非约束性形式。这一趋势未来如何与REAIM(负责任地军事化使用人工智能高级别会议)等独立轨道相衔接,将决定国际规制机制变化的方向[6]。

第三个变量是验证技术的发展与否。核不扩散体系得以运作的根本前提是存在核查这一验证手段。能否发展出从外部验证AI模型能力与风险的技术方法论,例如确保独立评估机构对模型的访问权等方式是否具备实效性,将改变核-AI类比本身的政策说服力。Anthropic和OpenAI承诺的接受独立评估机构监督[14],究竟是流于形式,还是能发展为实质性的验证体系,将是关键所在。

第四个变量是企业内部人士风险叙事的公信力之争。如同围绕安德鲁·杨转述的“OpenAI的Hugging Face黑客机器人在整个互联网植入了自我复制代码”主张的验证攻防战一样[16],如果风险叙事本身的事实关系受到质疑的案例反复出现,那么动员核-AI类比所产生的政治动员力可能会迅速耗尽。在这种情况下,讨论的重心有可能从生存风险框架转移到可验证的具体危害因素管理上来。

从此处起需要 3 积分

情景分析之后的正文可使用积分阅读。

登录后继续阅读

*本文为使用 AI 从韩语原文翻译而来,部分译文或语感可能存在偏差。

本报告由 EAI 研究员策划,基于 AI 辅助的精细研究,并由 EAI 研究员最终撰写的深度分析报告。

← 返回 · ← 首页 · ← 返回列表