来源:手机凤凰网
今年春天有一份美军情报差点把两个核国家往开战边缘推。 报告写得很硬:一艘中国船在中东跑,货里是核武器计划部件。 武装登船组已经待命,军用飞机已经上天,行动前一刻才有人深查来源,结果发现整份东西是聊天机器人编的,一名知情者原话是“完全错误”,还“几乎引发战争”。
这事儿是CNN在9月18日通过多名知情人抖出来的。 时间卡在美国对伊朗开打的那阵,地点逻辑绕到夏威夷的太平洋特种作战司令部,货物清单从那边出,分析师丢给AI,AI把开源情报和美国政府手里的机密信号情报搅在一起,直接给出“运核部件”的结论。
更离谱的是第二步。 分析师不单问了一句,又用另一个AI把错误判断套成标准情报格式发出去。 美军内部对“标准格式报告”天然高看一眼,格式一对,指挥链里不少人就当真货接了。 等拦截方案、登船方案、飞机调度都往前推了,才有人回头核来源,发现核心货物识别全是模型幻觉。
一名前高级官员后来跟媒体说,美军内部这些工具“大多只是商用产品换了个包装”。 不同部门用不同模型,安全标准还不统一,有的走涉密网,有的接开源数据,有的把两者混着喂。 出问题不是某个模型笨,是整条链都默认“AI先出稿、人再签字”,速度被放到第一位,核验变成走形式。
赫格塞斯这块锅,美媒这次基本贴脸扣。 1月9日他签了国防部《人工智能加速战略》,口径是“AI优先”,要把AI塞进作战、情报、管理三大块,支撑超过300万军人和文职。 1月12日他又跑到得州星舰基地讲“自由兵工厂”,说要扫清美军内部阻挡人工智能的障碍,用战时速度推技术,学SpaceX快速原型、快速失败迭代。 1月相关文件还提,要破除老旧IT和审批壁垒,把先进模型往指挥部、战场系统里塞。
速度一上来,基层分析师的压力最直接。 AI出稿比人工快,标准报告又容易过审,于是“先用机器人跑一遍、再自己润成军情”就成了隐性习惯。 军内有人吐槽,AI能让你更快得到一个烂主意。 这次中国船事件就是把这句吐槽变成事故:烂主意没停在屏幕里,一路走到军机升空。
同样用AI和过时数据,美军对伊朗那头完全另一种画风。 2月28日,伊朗霍尔木兹甘省米纳卜一所女子小学被空袭。 美军欧洲司令部后来承认是美军所为,初步调查说目标坐标用了国防情报局的“过时数据”,那片建筑十多年前和革命卫队设施同属一个综合体,后来建墙分隔、改成学校,数据库没跟上。
伤亡数各信源不太一样。 央视转引早期说法为160多人死亡;国际在线转纽约时报/华盛顿邮报线索写170多人、大多儿童;伊朗方面后续通报有168名学生、另加教师;部分媒体汇总写至少175人。 无论取哪个数,都是儿童占大头。 美军内部还用Palantir的Maven智能系统做目标排序,系统里嵌了Anthropic的Claude,部分媒体和分析把“过时库+AI建议”并列当诱因。
有意思的对照在这:伊朗小学这边,旧数据标成军事目标,AI系统给出优先级,指挥官赶进度签字,炸弹直接下去;中国货轮这边,同样由AI出“高价值核情报”,军机都升空了,却在临门一脚被叫停复核。 不是美军AI对中国船更聪明,是对伊朗可以赌“误炸成本可接受”,对中国得重新算拦截后会不会被反制、会不会升级为武装冲突。
1993年银河号那会儿,美方凭所谓化学武器原料情报在公海拦中国货轮,登船检查什么违禁品都没查到,事后也没有正式道歉。 三十多年后换成AI写报告,工具从人工线人变成聊天机器人,套路还是先有怀疑、再找证据、证据可以是编的。 2003年鲍威尔在联合国举那管“洗衣粉”说大规模杀伤性武器,后来伊拉克WMD假证被反复复盘,也是先定动武方向、再让情报配合。 AI只是把这种配合做得更快、更像标准件。
这次美媒挑在9月爆,也跟国内反AI情绪对上了。 2026年7月OpenAI承认模型在Hugging Face安全测试里出过越界问题,叫“警告枪”;5月谷歌Gemini在网络安全测试里自主渗透三家公司,也被拿出来当AI失控案例。 军方自己又刚推300万人用AI、Gemini/Grok等商用模型进国防部网络,争议叠在一起,媒体把“差点对华开战”的个案往赫格塞斯头上引,就很顺手。
具体流程漏洞也清楚。 第一,货运清单进聊天机器人,开源和机密信号不隔离,模型用什么权重、怎么融合,分析师未必看得懂。 第二,第一次AI给结论,第二次AI套格式,两次都无人做独立交叉源核验。 第三,标准情报格式自带信任背书,传到特种作战和太平洋链路后,拦截、登船、飞机起飞按“高置信情报”准备。 第四,不同司令部模型不一致,有的可能商用换皮,有的可能政府版,但上层没有统一验证门槛。
CNN说目前不知道被误判的到底是什么货,也不确认分析师用的是纯商用还是政府定制;太平洋司令部和五角大楼对事件没回应。 也就是说,公开信息只能还原到“AI出假货—标准报告过审—登船机降准备—临门复核叫停”这一层,再往后的追责、模型名单、船只身份,都没放出来。
从已有碎片看,美军这套AI化情报有三个硬伤。 模型来源不透明,前官直接说内部工具多是商用换皮;数据时效不审计,伊朗小学用十年旧图,中国船事件用混合信号,都缺回看;人工复核被格式绑架,标准报告一出,指挥链容易把“像正规文件”等同于“结论正确”。 这三件事不修,下次不一定有人踩刹车。
赫格塞斯的战略里写的是“AI优先、重构流程”,不是“AI替代人开火”。 可基层落地时,速度指标、产出数量、目标清单规模全压过来,人就容易把AI当初稿机器,自己当排版工具。 伊朗是炸弹先落、再查数据库;中国船是飞机先飞、再查报告源。 两次都证明问题不在某次提示词,而在把“加速”放在“可溯源”前面。
银河号当年靠人工疑罪从拦,伊拉克靠试管疑罪从打,伊朗小学靠旧库加AI疑罪从炸,中国船靠聊天机器人疑罪从起飞。 工具从传真、试管换到大模型,共同点是只要目标被标成高价值,核验就容易被作战节奏吞掉。 这次只是军机升空后有人多问了一句,才没把“核部件”幻觉变成海上对峙。