战机已经呼啸升空,全副武装的特战队员正在甲板待命,准备强行登上一艘行驶在公海上的中国货轮。
在美军指挥部的雷达屏上,这场拦截被定义为最高优先级的紧急军事行动。导火索是一份在军方内部秘密传阅的情报。在中东局势最紧绷的关口,这艘中国货轮正涉嫌运送“用于核武器项目的核心部件”。一旦在公海擦枪走火,后果不堪设想。
然而,就在突击队登船前的最后关头,有人突然往下多扒了一层原始单据,整个指挥链条瞬间陷入死寂。
根本没有什么核武器零件,甚至整份情报完全是虚构的。这篇言之凿凿、盖着正式格式印章的情报报告,不是潜伏特工搞来的密电,而是一名特战司令部的分析员用内部 AI 对话机器人临时生成的。
内部人士在事后对媒体直言,这次荒唐的乌龙“差点引爆一场大国战争”。
用 AI 查出的假线索,顺手用 AI 包装成绝密简报
整场险情的发生,没有任何复杂的黑客攻击,只是一次典型的自动化失控。
当时,太平洋特战司令部的分析员拿到了一份货轮舱单数据和零散的公开信号。面对堆积如山的信息,这位年轻人没有一条条查验货物编码,而是直接把数据灌进了对话模型——用内部老兵的话说,军方用的所谓专属智能体,“其实就是把商业模型套了个马甲、抹了层口红”。
模型在处理杂乱的开源信息和密电碎片时,突然产生了严重的幻觉,凭空把普通的民用货物推理成了核原料组件。
如果事情到这里停住,这不过是一个普通技术失误。但最要命的推力来自下一步。分析员不仅相信了这个推理,还立刻指示 AI “按照标准军用情报简报的格式,重新包装输出”。
原本只是模型在概率分布里随机抖动出的一段胡话,一眨眼就被套上了严密的情报编号、密级标注、专业术语缩写和无可挑剔的行文逻辑。在庞大的军事官僚机器里,没有人会细读模型内部的注意力权重,但每个人都认得这个权威公文格式。
一份毫无物理依据的虚假推理,就这么完成了“信用洗白”,一路绿灯送上了战区指挥官的作战桌面。
格式越严密,系统里的每个人越不敢怀疑
很多人以为,把人类放在流程里(Human in the loop),就能挡住机器犯傻。
但现实给所有人泼了盆冷水:当大模型以极高效率吐出排版完美、措辞严密的报告时,处于中间环节的人类并没有变成严格的把关人,反而变成了机器的盖章工具。
正如参与调查的人士给出的评价,“AI 只是让你以十倍速冲向一个极其糟糕的馊主意”。
年轻一代的从业者天然对屏幕上流利生成的文字抱有极高信任;更关键的是,系统在无形中对所有人施加了“吞吐量反压”。当原本需要三天核实的工作被压缩到十分钟生成,后方的核对带宽瞬间被彻底击穿。面对一份格式挑不出任何毛病的高分报告,谁会冒着被指责“延误战机”的风险,退回去把几百条原始货单重新核查一遍?
每个人都默认上一级已经交叉验证过,下一级以为前置系统早就跑过物理校验。这种对生成的虚假安全感,让整条流水线在遇到致命错误时全速狂奔,直到枪口顶上靶心才险些撞墙。
机器负责生成时,按下物理刹车的必须是独立的只读探针
这个近乎荒诞的现场,戳破了所有自动化工作流的一个致命盲区:把“文本生成的严谨度”当成了“真实世界的正确性”。
模型擅长的是在上下文里把话说圆,它在本质上是一个无法对物理实体负责的补全引擎。要让这样的系统在关键领域跑起来,靠给提示词加上“请务必实事求是、禁止胡说”毫无意义,必须从底层拆掉几个错误的假设。
首先要切断生成者的自证闭环。 一个系统如果既让同一个智能体负责收集事实,又让它负责下达定论,最后还让它负责润色公文,它必然会为了逻辑通顺而编造中间证据。输出高危结论的通道,与负责核验原始单证的通道必须彻底物理隔离。只负责核实的检查节点必须是只读的,它唯一的任务就是拿着不可篡改的原始单据做硬碰硬的物理比对,只要找不到物理指针,任何修辞再华丽的结论都必须原地驳回。
其次要在高危动作前建立强制熔断。 无论是出动战机拦截,还是在生产环境批量删除数据、调用银行账户打款,任何带来不可逆物理后果的动作,都不能单凭概率模型的推论触发。在动作生效的最后一米,必须有一道与生成逻辑完全无关的物理闸门。只要置信度存在模糊、或者缺少多重物理事实支撑,系统必须立刻就地阻断,拒绝执行并强制鸣笛。
不能把光速打字的打字机,当成能看清公海波涛的雷达。在物理世界里,能够阻止灾难的,从来不是辞藻多么工整的分析,而是那颗在按下扳机前、敢于直接拔掉电源线的独立保险栓。
