Palantir Maven AI目标选择系统误炸争议及其对中等强国军事AI的启示
执行摘要
2026年2月,美伊战争期间,Palantir公司的Maven AI目标选择系统将伊朗米纳布一所小学错误地指定为打击目标。该事件导致包括120名儿童在内的150余人死亡。联合国实况调查团认为此举可能构成战争罪,但美国白宫立即否认了调查结果。此事件揭示了AI目标选择速度压缩人工验证时间的结构性问题,并暴露出在同一系统群向多个盟国进行标准化供应的结构下,错误可能蔓延的风险。包括韩国在内的中等强国,有必要在美国主导的AI指挥控制(AI-C2)标准接受过程中,先行探讨确保对数据层和验证程序的独立控制权问题。
I. 事件背景分析
Palantir Maven AI目标选择系统误炸伊朗平民争议:事件背景分析
1. 事件背景与经过
2026年2月28日,美国和以色列对伊朗发动攻击。此次空袭导致伊朗最高领袖阿里·哈梅内伊死亡,伊朗的核设施与军事设施也遭到打击[5]。虽然在巴基斯坦的斡旋下达成了停火,并于6月签署了协议,大规模战斗得以停止,但双方之后仍以对方违规为由,进行了零星的交火[5]。
在这场战争初期的38天里,基于AI的目标选择系统被用于识别约13000个目标[4]。其中之一便是伊朗南部米纳布的一所小学。2月28日,一枚战斧导弹击中了这所学校,导致包括120多名儿童在内的150余人死亡[14][11]。瑞典媒体《每日新闻报》(SvD)报道称,此次空袭导致120名儿童死亡,并透露事件的经过正在美国国防部内部逐渐浮出水面[1]。同在2月,拉梅尔德的一个体育中心也遭到空袭,造成另外22人死亡[16][17]。
伊朗当地媒体《德黑兰时报》将此事件与越南战争中的美莱村屠杀相提并论,并以“每个美国人都应扪心自问的问题”为题,正面追究美军的责任[11]。这表明,在伊朗内部,该事件被视为美国反复杀害平民模式的延续,而不仅仅是一次单纯的误炸。
2. 当前状况
2026年9月17日,联合国伊朗问题独立国际实况调查团发布了一份长达18页的报告,指出有“合理依据”认为对米纳布小学和拉梅尔德体育中心的空袭可能构成战争罪[13][17]。该报告计划于9月21日在日内瓦向联合国人权理事会正式提交[12]。联合国调查团的结论是,这两次空袭均属无差别攻击,并造成了平民死亡和民用基础设施的破坏[17]。
白宫立即驳斥了这一调查结果,称其为“一派胡言”[12]。美军在3月的国会听证会上承认,在与伊朗的战斗中利用了先进的AI工具来快速处理信息,但同时强调,对目标的最终决定是由人做出的[15]。然而,奥地利媒体《标准报》援引CNN的报道称,Palantir的AI未能识别出导致米纳布儿童遭空袭的图像资料已过时效[10]。该报道还披露,另一起AI错误险些引发了针对中国的军事行动[10]。这表明,米纳布事件并非一次性错误,而是正在演变为对整个Palantir系统可靠性的质疑。
美国国会也正式讨论了这一问题。在9月16日的汤姆·兰托斯人权委员会听证会上,证人指出,仅靠人工批准程序难以保证对基于AI的决策进行实质性控制[7]。他们担忧,随着AI在目标识别和推荐中扮演的角色日益扩大,人类可进行干预的时间本身正在被压缩[7]。
3. 主要行为体及立场
美国国防部与白宫反复强调最终目标决定权在于人类的原则,表现出将责任限定在指挥系统内部而非系统本身的姿态[15]。然而,对于联合国的调查结果,他们未提出任何依据便予以否认,被评价为对查明真相持消极态度[11][12]。
伊朗政府与当地媒体将此事件定性为美国反人类军事行动的延续。《德黑兰时报》将其与美莱村屠杀的比较,显示了伊朗国内舆论正以历史性战争罪的框架来解读此事件[11]。此外,伊朗于2026年3月发动了名为“史诗之怒行动”的无人机攻击,损坏了中东地区三处隶属美国的AWS数据中心。伊朗官方媒体称,打击这些设施的原因是它们为美军提供支持[2]。这表明伊朗正将美军基于AI的作战基础设施本身设定为报复目标。
联合国实况调查团对美国作出了可能构成战争罪的结论,从而加重了追究其违反国际人道法责任的论调[13][17]。同时,调查团也指出伊朗政府在镇压针对生活成本上涨的抗议示威过程中使用了“压制性法律”和“致命武力”,从而对双方都采取了批判性的平衡立场[13]。
Palantir公司因向美国、以色列和英国军队提供AI软件,支持其在加沙和伊朗的空袭而处于争议中心。有指控称,Palantir的系统将陈旧的图像资料误认为更新后的资料,从而导致了平民伤亡[10],这使得对其公司技术可靠性本身的质疑日益扩大。
美国国会人权委员会跨党派地将AI目标选择速度超越人类验证能力的结构性风险作为正式问题提出,这一点使其成为一个与行政部门立场不同的制衡力量[7]。
4. 核心争议点
第一个争议点在于“人工控制”原则是否得到了有效运作。尽管美军解释称最终决定由人做出[15],但已有案例表明,连AI提供信息的时效性都未能被过滤掉[10],这加剧了人们的怀疑,即人工批准程序不过是一个形式上的挡箭牌。
第二个争议点是国际法上的责任归属。联合国调查团的战争罪判定[13][17]与美国白宫的全面否认[12]之间的鸿沟表明,关于在以AI为媒介的军事行动中,由谁以及如何承担法律责任的国际规范尚未建立。
第三个争议点是向盟国的扩散问题。日本防卫省已在其2027财年预算中列入了为自卫队统合作战司令部引进Palantir Maven系统的费用[3][6],这一案例表明,像米纳布事件中那样带有风险的系统,正在没有经过验证的替代方案的情况下,扩散至盟国的指挥控制体系。这种将本国数据体系纳入美国军事本体标准之上的决策,被评价为“很可能因转换成本增加而形成结构性依附”[3]。这一点直接关系到韩美日小多边安全合作中的指挥控制互操作性讨论,以及韩国在战时作战指挥权移交后的作战自主性问题[6]。
II. 事件深度分析
Palantir Maven AI目标选择系统误炸伊朗平民争议:深度分析
1. 根本原因分析
米纳布事件的表面原因是图像资料的时效性错误。《标准报》援引CNN的报道称,Palantir的AI未能识别出导致对学校发动空袭的视频资料已过时效[10]。这意味着系统未能过滤掉目标被指定时的建筑物用途与实际打击时用途可能不同的情况。
然而,这与其说是技术缺陷,不如说是速度与验证之间结构性矛盾的产物。在美国国会听证会上,证人指出,随着AI在目标识别和推荐中扮演的角色日益扩大,人类可进行干预的时间本身正在被压缩[7]。即使保留了人类最终批准的程序,但如果进行批准的时间窗口跟不上AI产生的信息流速度,那么批准就将流于形式。战争初期38天内识别出13000个目标这一事实本身,就显示了这种压缩的规模[4]。在日均处理超过300个目标的流程中,人工验证员逐一核对单个目标的图像时效性或上下文错误的能力,在结构上是受限的。
更根本的问题在于,Palantir系统的错误并非一次性偶然事件。同期,另一起AI错误险些引发针对中国的军事行动的消息也被一并报道[10]。这两起事件在同一系统群中反复发生,表明错误的原因可能并非个案的偶然性,而是系统设计和操作流程中普遍存在的内在脆弱性。
2. 结构性背景
从安全结构层面看,此事件发生在Palantir向美国、以色列和英国军队供应同一AI软件系列的结构之上。Palantir的Maven体系已有支持加沙空袭的记录,在伊朗战争中也直接运用了类似的架构。这意味着,由单一供应商创建的目标选择本体在多个战场上被反复使用,这其中蕴含着一种风险,即在特定缺陷被发现之前,它可能会在多次行动中累积性地运作。东亚研究院(EAI)此前的分析曾指出,Palantir的Maven体系构建于“美国国防部近20年积累的联合全域指挥控制(CJADC2)构想和本体标准之上”[3]。标准化的优势,其另一面便是错误蔓延的可能性。
从政治结构层面看,白宫将联合国调查结果斥为“一派胡言”的反应表明,在美国行政部门内部,此事件被当作一个政治防御的对象,而非军事行动的正当性问题来处理[12]。国防部反复强调最终目标决定由人做出,但对于做出该决定时所依据的信息以及时间宽裕度等具体情况,却未作明确答复。这与在人与AI之间刻意保持责任归属模糊的政治动机不无关系。
从国际规范结构层面看,联合国伊朗问题独立国际实况调查团认定米纳布小学和拉梅尔德体育中心空袭可能构成战争罪[13][17],这揭示了现有规范在AI目标选择系统应如何满足国际人道法中的区分原则与比例原则方面存在空白。对于AI识别目标、人类批准的混合决策结构,关于战争罪责任应归属于谁的国际法标准尚未建立。
3. 历史先例与类似案例比较
《德黑兰时报》将此事件与越南战争中的美莱村屠杀相提并论,并打出了“每个美国人都应扪心自问的问题”的标题[11]。这种比较表明,伊朗内部舆论将此事件视为美军杀害平民模式的重演,而非技术性错误。但与美莱村屠杀的根本区别在于,后者是地面部队的直接屠杀,而米纳布事件则经过了基于算法的目标识别和远程打击这一媒介。责任的归属从个别士兵的违令行为转移到了系统设计和操作流程的问题上,这是本次事件的新特质。
一个更为贴近的先例是在加沙地带使用Palantir及类似AI目标选择系统的历史。Palantir已有支持加沙空袭的经验,在此过程中,类似的速度与验证之间的矛盾也曾被指出。在伊朗战争中同样的问题再次出现,这一事实佐证了Palantir系统的缺陷并非特定战场的特殊情况,而是系统本身固有的、可重复的风险。
此外,同期发生的针对中国的误报事件是一个重要的比较对象[10]。这表明,目标选择AI的错误不仅会带来平民伤亡这样的人道主义后果,还蕴含着可能引发大国间偶然军事冲突的战略风险。这与冷战时期因预警系统失灵而多次引发核战争危机的案例在结构上本质相似。不同之处在于,这一次,辅助人类判断的AI成为了失灵的媒介。
4. 事件发展的关键变量
联合国人权理事会是否采取后续措施是第一个变量。计划于9月21日在日内瓦报告的调查结果,后续是否会提交至安理会或国际刑事法院,还是会在美国的否认声中沦为政治争议,这将决定此事件在国际法层面的影响力[12][17]。
美国国会的立法应对程度是第二个变量。汤姆·兰托斯人权委员会听证会上提出的人工控制有效性问题[7],最终是会促成对AI目标选择系统引入法律规制或强制性验证程序,还是会在国防部“最终由人决定”的原则性答复层面被平息,这将是关键。
Palantir系统向盟国扩散的速度是第三个变量。在日本防卫省已在其2027财年预算中列入为自卫队统合作战司令部引进Maven智能系统费用的情况下[3][6],像米纳布事件这样的缺陷会对盟国的引进讨论产生多大影响,尚待观察。如果在缺陷暴露后,确保互操作性的动因仍被置于优先地位,那么这将与东亚研究院(EAI)指出的“结构性依附”问题相结合,加剧在盟国缺乏自主验证能力的情况下,同样错误反复发生的风险[3]。
Palantir与美国国防部合同关系的透明度是第四个变量。如果错误的责任在于供应商的软件设计缺陷,还是国防部的操作流程问题未能得到明确界定,那么就难以降低类似事故在其他战场上重演的可能性。
*本文为使用 AI 从韩语原文翻译而来,部分译文或语感可能存在偏差。
本报告由 EAI 研究员策划,基于 AI 辅助的精细研究,并由 EAI 研究员最终撰写的深度分析报告。