几乎引发海上战争的AI误判
共同社报道:美军一度因AI将一艘中国船只识别为装载核部件而准备发起行动,却在执行前几分钟紧急叫停。韩国媒体也披露此事件,暴露出当前军事AI条约的空白可能危及生命。
一场险些酿成战争的误报
美国军方制定了一项针对中国船只的作战计划。触发点是人工智能系统将该船识别为载有核部件。就在发射前几分钟,有人按下了停止键。
共同社低调发布了这则报道——没有泄密、没有五角大楼简报,只有报道本身。真正引人注目的不是细节,而是其暗示的意味:一套算法差点对世界两大军事强国之一引发海上事件,而拦住它的完全是人工判断。
这是整篇报道中最重要的一句话。AI 完成了它的工作,无懈可击。问题在于,没有人能在决策循环中设置足够有力的紧急切断机制。
据共同社报道,事件发生在一处争议海域,美中海军部队日常在此近距离活动。一套由人工智能驱动的情报与监视平台——隶属于整个印太地区部署的自动化目标识别与信号情报网络——生成了一份高置信度评估,认定某艘中国船只正运送与核武器计划相关的部件。该评估被直接送入作战规划流程,触发了拟攻击该船的打击计划草案。
计划已经完备。只是在触发后的几分钟内,一名人类决策者介入,阻止了命令继续向下传达。那种干预具体形式是什么——一个电话、审查委员会中的一票否决、还是对原始传感器数据的临场重新评估——至今未公布。但这一事件序列本身,足以改变我们对军事行动中 AI 的认知。
两个媒体市场,同一事件
共同社的报道印证了韩国媒体此前的流传:一次海上 AI 监视险些升级为公开冲突的近失事件。两家独立的东亚新闻机构报道了同一事件——很可能来自同一保密消息源——这表明这不是一起孤立的技术故障,而是 AI 辅助瞄准系统在争议水域部署时嵌入的结构性问题。
西方通讯社尚未跟进这则报道。这种沉默很重要。英语世界对军事 AI 的报道大多聚焦于生成式模型、聊天机器人和政策辩论。而现实情况——AI 将瞄准建议输入实战指挥链——受到的审视少得多,尽管它正在美中海军之间实时测试。
报道的地缘视角同样值得玩味。东亚媒体将此视为区域安全危机,因为他们正是那片事发水域的邻国。而对华盛顿的记者而言,这是一个盲区:AI 风险的公开讨论与那个机密世界之间,存在巨大鸿沟——在那里,风险正在真实船只、真实船员和真实地缘政治引爆点上展开。
谁胜谁负
即时赢家是下令中止任务的分析员或指挥官。但真正的赢家是那艘中国船只上的水兵,以及美国方面本应执行攻击任务的人员。他们之所以还活着,是因为系统设计保留了"人在回路"的保障机制。
输家则是"AI 在军事领域使用是安全的,因为人类保持控制"这一论点。这次事件恰恰证明相反的情况:人类确实在回路之中,但回路的容错空间极其狭窄。一套 AI 生成的情报产品——可能在几秒内完成,而非传统全源分析组所需数天——已经启动了一份作战计划的制定。关键问题不在于人类的否决权这一次是否有效——它确实生效了——而在于在另一种情境下,从一艘被标记的船只到发射打击之间,相隔的只是多少毫秒的运算时间。
还有一个次生影响值得关注。当 AI 系统对涉核目标发出高置信度警报时,它不会只停留在仪表板上。它会引发一系列连锁反应:为侦察资产下达任务、预先部署打击方案、向政治领导人汇报、调动指挥控制基础设施。AI 警报所产生的动量可能极为庞大,而要抵消这种动量,不仅需要意识到可能存在问题,还需要足够的权限和时间说出这句话。
无人愿提及的条约空白
目前没有任何国际协议规定 AI 生成的情报在进入军事决策循环前如何验证。《日内瓦公约》规范的是武器,而非处理器。《特定常规武器公约》并未预见算法误判的情形。核军控条约约束的是库存,而非通过神经网络处理的情报数据。
这一空白此刻暴露无遗。AI 将一艘商用或军民两用船只标记为携带核材料,这类场景困扰着全球各情报机构。其技术上的可能性已有充分认知:合成训练数据、对抗性输入和模式匹配错误,均可能产生高置信度的假阳性结果。而当此类输出进入时间紧迫的瞄准管线时,风险会成倍放大。
这一空白尤其危险之处,在于其不对称性。一方可以探测和标记,而另一方在任何条约框架中都没有对等的验证机制。如果未来在某次事件中,人工否决环节缺失——无论是由于自动化渗透、压缩决策时间,还是故意减少打击链摩擦的政策选择——国际社会将没有任何公认标准可依。没有任何中立框架来判断 AI 评估是否合理、反击是否对等,或升级是否正当。
条约空白也带来了公信力问题。每一次 AI 误报被人工干预化解,都在强化"军事 AI 可控"的叙事。但每次险些出事,也为下一次埋下了种子。指挥官开始更加信任系统,审查周期缩短,人的角色变得越来越形式化。下一次事件未必能有同样幸运的结果。
接下来会发生什么
共同社的报道表明,美方防务体系内部已知悉此事,这意味着五角大楼和参联会将审查允许此事件链发生的协议。可能的结果是:收紧人工否决要求、强制设定对 AI 标记目标的审查时限、并将 AI 生成情报产品正式归类为需交叉验证后才能进入作战规划。
这些都不会公开宣布。军事演习、交战规则和传感器协议并非新闻发布会的主题。但走向可以预测:下一层作战条令将围绕防止此次同类失误来撰写。
然而,另一股力量也在发挥作用。正在审查此事的机构,同时也在推动缩短瞄准链延迟、将 AI 更深融入作战决策。谨慎与速度之间的张力,正是军事 AI 治理的核心戏剧,而此次事件将被双方援引。主张强化保障措施的一方,会以这次险些出事的案例证明当前架构存在不足;主张继续整合的一方,则会以人工否决的成功作为系统按计划运行的证据。
最终的平衡点,可能是在纸面上增加更多保障、在实践中推进更多自动化——这是政策滞后于部署的老路,而双方都会宣称自己赢得了胜利。
更广泛的信号
这不是 AI 系统首次误判目标。数十年的导弹防御和侦察历史中,充满了因计算错误而引发的误报。如今的不同之处在于速度和规模。一个虚假雷达回波曾经需要数分钟来分析,而 AI 系统可以在几秒钟内得出看似合理的结论,压缩了决策窗口,也增加了高压之下人工否决被跳过的概率。
共同社的报道明确了一点:否决发生了,而且及时。但它之所以发生,是因为系统设计允许否决的存在。下一次考验将在系统不允许否决之时到来。在军事瞄准链中建立具有约束力的 AI 验证国际标准之前,下一次考验只是时间问题,而非会不会发生的问题。
真正的危险不在于 AI 有意发动战争,而在于 AI 创造出一种使战争成为阻力最小路径的条件——一条由看似可信的警报、压缩的时间线和机构信任机器所铺设的道路。那艘中国船只上的水兵,躲过了一场设计上的失误,而非意图上的失误。问题是,下一艘船是否还有如此好运。