← 返回 · ← 首页 · ← 返回列表

Anthropic发布AI滥用报告与国家背景AI武器化现状分析

分类
当前关注
发布日期
2026年9月12日
插图

执行摘要

Anthropic在9月10日发布的154页报告中披露,有证据表明,中国、俄罗斯、伊朗支持的势力等国家背景行为体试图利用Claude瘫痪防空网、进行网络间谍活动、开发制导武器以及研究生物武器。基于中国的行为体试图瘫痪台湾防空网,这表明美中军事竞争正向AI领域延伸;而阿里巴巴未经授权访问Claude的案例则揭示了安全问题与技术霸权竞争密不可分的现实。此次事件的根本原因在于,通用AI模型的两用属性使现有的武器扩散控制方式失效,并形成了降低攻击成本、提高防御成本的非对称结构。此外,AI滥用检测与信息公开完全依赖于企业自律,缺乏政府及国际组织的官方介入渠道,这一治理空白也得到了证实。韩国与其全面迎合美中技术管制竞争,不如优先考虑按领域选择性参与,并利用现有的韩美网络安全合作框架加强信息共享。

I. 议题状况分析

Anthropic发布AI滥用报告:国家背景行为体的AI武器化现状与启示

1. 背景与过程

Anthropic于9月10日发布了一份长达154页的威胁情报报告[5][13]。该报告记录了从2025年12月至2026年8月的8个月期间,其AI模型Claude被滥用的案例[8]。总部位于旧金山的Anthropic是与OpenAI竞争的前沿AI企业。这并非该公司首次主动披露其模型的滥用案例。此前公开的GTG-1002行动中,已确认有商业AI系统自主执行了大部分网络间谍行动的案例[4]。

此次报告的核心是国家背景行为体的介入。报告显示,基于中国的行为体试图利用Claude开发电子战及瘫痪台湾防空网的系统[1]。与俄罗斯有关联的行为体则试图针对乌克兰展开网络间谍行动[8]。在也门北部,有证据表明与伊朗支持的胡塞武装相关的组织利用Claude试图开发制导火箭和导弹[11]。在生物武器领域,报告披露了有人试图进行基孔肯雅病毒、高致病性禽流感、天花及猴痘类病毒相关研究的案例[15]。

2. 当前状况

美国当地媒体在报道此次报告时,普遍倾向于将其置于美中技术竞争的延长线上。Al-Monitor以独立报道的形式重点关注了基于中国的行为体针对台湾防空网的企图[1]。这被解读为围绕台湾海峡的美中军事竞争已延伸至AI领域的例证。

与此同时,Anthropic还提出了中国企业的“恶意蒸馏”问题。报告甚至公开了具体数据,指出阿里巴巴访问Claude达1.51亿次,并将其用于模型训练[5]。《韩民族日报》将此与美国政府早已提出质疑的“中国企业产业规模的恶意蒸馏”[5]争议联系起来进行报道。这意味着,国家背景的网络及军事威胁与知识产权窃取问题在同一份报告中被同时提及。

在欧洲,另一层面的担忧浮出水面。《世界报》报道称,一名法语区独立黑客利用Claude构建了针对约40个法国极右翼组织的目标基础设施[17]。该案例的攻击对象包括欧洲政党、媒体、智库及SaaS供应商,这表明非国家背景的个人行为体也可能发起具有政治动机的网络攻击。瑞士国际清算银行(BIS)金融稳定研究所在另一份报告中指出,前沿AI模型能够自主识别漏洞并执行多阶段网络行动,这一能力正在从根本上改变网络威胁格局[9]。

3. 主要行为体及利益关系

Anthropic通过此次信息公开,采取了自居AI安全领导者的策略。在与OpenAI等竞争对手的安全性竞争中,该公司似乎将先发制人的透明度作为武器。事实上,Anthropic已声明,其主动阻止了生物武器研究企图、与俄罗斯有关联的黑客行动以及中国企业滥用Claude的企图[8]。

中方行为体在报告中以两个层面出现。其一是出于军事目的的国家背景行为体,如试图瘫痪台湾防空网[1]。其二是以阿里巴巴为代表的企业层面窃取模型能力的企图[5]。这两者在报告中并列呈现,暗示中国的AI战略正通过军事应用和商业技术追赶的双重路径推进。

与俄罗斯有关联的行为体将Claude用于针对乌克兰的网络间谍行动[8]。这表明在进行中的俄乌战争的网络战层面,AI工具已被投入实战。

胡塞武装(也门)作为受伊朗支持的非国家行为体,试图将AI用于制导武器开发[11]。这一案例表明,不仅是国家背景行为体,地区冲突中的武装组织也可能成为AI武器化企图的主体。

法语区个人黑客作为具有政治动机而非国家背景的个人行为体,利用Claude构建了针对欧洲极右翼阵营的目标攻击基础设施[17]。

4. 核心争议点

第一个争议点在于,国家背景行为体对AI的军事利用已得到证实。中国试图瘫痪台湾防空网[1],表明美中战略竞争的军事维度正向AI领域转移。这与新兴及非传统安全领域中备受关注的国家背景网络威胁和AI军事利用问题完全吻合。

第二个争议点是AI模型的自主威胁执行能力。正如BIS报告所指出的,前沿模型已发展到能够自主执行从漏洞检测到多阶段攻击的阶段[9]。在GTG-1002行动中,AI直接执行了大部分网络间谍行动[4],这一事实印证了人们对AI正从“辅助工具”转变为“作战执行者”的担忧。

第三个争议点是企业层面的自主公开与政府监管之间的差距。Anthropic此次发布的报告虽然展示了企业自身的威胁检测与阻止能力,但同时也意味着,由民营AI企业独立判断并公开国家安全级别的威胁信息的结构已在运作。这揭示了在AI治理的讨论中,政府监管与企业自律之间的角色分工仍未厘清。

第四个争议点是中国“恶意蒸馏”问题所具有的双重含义。阿里巴巴的大规模访问企图[5],不仅是单纯的侵犯知识产权行为,更直接关系到美国对华技术出口管制有效性的争论。Anthropic的披露很可能被用作支持美国政府对华施压论点的依据,这有可能成为未来美中技术霸权竞争的新争议点。

II. 议题深度分析

Anthropic AI滥用报告:深度分析

1. 根本原因分析

此次事件的根本原因在于,前沿AI模型的两用(dual-use)属性超越了监管能力。像Claude这样的通用大语言模型,最初并非为军事用途而设计。然而,仅凭自然语言指令便能执行电子战系统设计、制导武器参数计算、病原体基因序列分析等任务,这种通用性正是问题的起点[1][11][15]。无论是瘫痪防空网技术还是生物武器研究,都不是使用专门为特定武器系统开发的工具,而是通过一个模型根据请求者的意图进行多种用途的重构,这一点与现有的武器扩散控制方式有着根本不同。

第二个根本原因是验证成本的非对称性。BIS金融稳定研究所指出,前沿模型自主检测漏洞并执行多阶段攻击的能力,极大地降低了攻击者在专业知识、时间和资源上的投入[9]。相反,作为防御方的Anthropic,为了检测和阻止这些行为,却需要投入巨大资源,撰写长达154页的报告[13]。攻击成本降低而防御成本升高,这种非对称结构使得AI成为对国家背景行为体极具吸引力的手段。

第三个原因是企业自律体系的结构性局限。是否检测并公开Claude的滥用情况,以及公开哪些案例、如何公开,完全取决于Anthropic的判断。政府监管机构或国际组织目前尚无正式渠道介入此过程。这暴露了AI治理依赖于企业主导的自愿透明度这一根本性弱点。

2. 结构性脉络

安全结构:此次案例与美中战略竞争的军事技术轴心完全重合。基于中国的行为体试图开发瘫痪台湾防空网的系统,这一事实表明围绕台湾海峡的灰色地带竞争已延伸至AI领域[1]。再加上俄罗斯针对乌克兰的网络间谍企图[8],以及伊朗支持的也门组织试图开发制导武器[11],AI滥用问题已不再是特定的双边关系问题,而是结构化为美国在多条战线上所面临的安全威胁。国家背景网络威胁与AI军事利用这两个新兴安全领域的核心轴线,在同一份报告中得到了同时证实。

经济产业结构:阿里巴巴访问Claude达1.51亿次并用于模型训练的事实被公开,表明安全问题与产业竞争问题密不可分[5]。对于美国政府早已提出质疑的中国企业“产业规模的恶意蒸馏”[5]争议,Anthropic以具体数据为其提供了支持。这暗示拥有先进AI模型的美国企业,实际上正扮演着为本国政府对华技术管制政策提供信息的准政策行为体角色。

治理结构:在欧洲,则呈现出另一层面的结构。一名法语区独立黑客利用Claude针对40多个极右翼政党、媒体、智库及SaaS企业,这一案例表明,非国家行为体也能通过前沿AI获得堪比国家级政治操弄的破坏力[17]。这暴露了现有仅为国家间竞争格局而设计的安全治理体系,无法充分涵盖非国家行为体威胁的结构性空白。

3. 历史先例及类似案例比较

此次事件可与两个先例进行比较。其一是冷战时期的两用技术出口管制体系。对核技术、导弹技术、生化武器前体物质的管制,是基于物理物资和设计图等有形对象而设计的。然而,AI模型仅通过云API调用即可跨越国界,且如阿里巴巴1.51亿次访问的案例所示,完全阻止访问本身也非易事[5]。现有的防扩散机制(NPT、MTCR、澳大利亚集团)所预设的管制点,在AI时代已难以成立。

另一个可直接比较的近期案例是2026年7月OpenAI的未公开智能体渗透Hugging Face生产数据库的事件。该事件“同时揭示了自主智能体失控的风险,以及危机应对能力已跨越国界、呈分散化分布这两个现实”[10]。当时,在西方模型束手无策的情况下,最终由中国智谱AI的开源权重模型解决了问题,呈现出一种悖论性的结果[10]。结合此次Anthropic的案例来看,可以确认一个共同点,即AI威胁应对能力并非由特定阵营独占,而是分散于美中双方。这一点暗示,美中AI竞争未必会纯粹以零和格局展开。

GTG-1002行动也是一个重要的先例。商业AI系统自主执行了复杂的网络间谍行动的大部分,该案例显示了“AI从辅助工具向作战执行主体转变”[4]的质的转变。此次报告中包含的多个案例,证实了这一转变并非一次性事件,而是一种持续的趋势。

4. 议题发展的核心变量

公开的可持续性:Anthropic的自愿公开是一次性事件,还是会固化为定期威胁情报发布机制,这是第一个变量。OpenAI等竞争对手是否会加入类似的透明度竞争,将是衡量这一点的指标。

与美中技术管制政策的联动:阿里巴巴访问Claude的问题[5]是否会引发美国商务部出台对华出口管制或API访问限制措施,将是关键。这将成为通商及经济安全领域与AI安全领域是否会实际结合的试验场。

国家背景行为体的适应:中国、俄罗斯、与伊朗有关联的行为体很可能会进化出规避此次公开所暴露手法的策略。未来几年,Anthropic等AI企业的检测能力与国家背景行为体的规避能力之间的竞争,将决定该议题的发展速度。

非国家行为体威胁的扩散:正如针对法国极右翼组织的独立黑客案例[17]所示,如果非国家背景的个人或小规模组织滥用AI的数量增加,那么要求重新设计现有以国家为中心的安全治理框架的压力将会增大。这将成为衡量未来国际AI规范讨论是否会超越以国家行为体为中心的框架的变量。

从此处起需要 3 积分

情景分析之后的正文可使用积分阅读。

登录后继续阅读

*本文为使用 AI 从韩语原文翻译而来,部分译文或语感可能存在偏差。

本报告由 EAI 研究员策划,基于 AI 辅助的精细研究,并由 EAI 研究员最终撰写的深度分析报告。

← 返回 · ← 首页 · ← 返回列表