← 返回 Siami 首頁

AI 幻覺險引發美中軍事衝突 美軍差點依 AI 假情報登上中國船艦

▲ 321 💬 253
AI 幻覺險引發美中軍事衝突 美軍差點依 AI 假情報登上中國船艦

編按:本文綜合整理自 Ars TechnicaCNN 原始報導,並加入 Siami 編輯部觀點與分析。

事件:AI 假情報差點引爆美中衝突

美國軍方根據一份「完全錯誤」且由 AI 工具協助生成的情報報告,險些在中東海域攔截並登上中國船艦。根據 CNN 報導,這份情報由美國特種作戰司令部的分析師提交,聲稱該中國船隻正在運輸核武器計畫相關零件。美軍當時已準備派出空中支援,準備進行攔截與登船行動,直到官員發現聊天機器人「不準確地辨識了船上裝載的物品」才踩下煞車。

一名消息人士告訴 CNN,這場由 AI 引發的烏龍「幾乎引發一場戰爭」。

CNN 引述四名知情人士指出,那名分析師使用聊天機器人分析關於該中國船隻貨運清單的情報。該聊天機器人「將開源情報與政府持有的機密信號情報融合在一起」,最終被打包成一份情報報告,幾乎引爆一連串災難性的後果。


「幻覺」從詞語到現實風險

這次事件是 AI 幻覺(hallucination)破壞專業報告可信度的重大案例之一。「Hallucinating」這個詞在 2023 年被《劍橋詞典》選為年度代表字,此後我們見過太多慘例:非虛構作家、記者、學術研究者、法官、醫師、警察機關、企業客服中心等,都曾被 AI 工具生成的虛構內容誤導。儘管有人嘗試用「請不要幻覺」這類可愛的提示詞來防範,部分研究人員認為,要徹底防止 LLM 產生幻覺可能根本不可能。

一般人會預期美軍在把 AI 用於情報分析時應該已經意識到這些問題。然而,美國國防部今年一月推出了「AI 加速策略」(AI acceleration strategy),目標是「讓所有合適的資料都能在聯邦式 IT 系統中供 AI 利用,包含各軍種與單位的任務系統」。

「AI 的好壞取決於它接收的資料,我們會確保那些資料到位,」國防部長 Pete Hegseth 在推出該倡議時如此表示。


國防部的 AI 部署速度

去年十二月,美國國防部宣布將採用 Google 的 Gemini for Government 作為其客製化「GenAI.mil」平台的基礎。上個月,該部門又把 Grok for Government 加入平台選項。Anthropic 也為美國情報作業提供客製版的 Claude。

今年六月,五角大廈一位代表向國會吹噓,已用生成式 AI 協助撰寫國會要求的報告,並有 150 萬名現役國防部人員使用過軍方的生成式 AI 工具。

早在 2023 年,美國國務院的《負責任的軍事使用人工智慧與自主性宣言》強調,武裝部隊「原則上」使用 AI 時,「應該謹慎權衡風險與效益,並盡量減少非預期的偏誤與意外」。該報告也主張,AI 系統的「可究責」使用必須始終有「人類在決策迴路中、負責任的指揮管制鏈」。

然而,自那時以來,我們已經看到完全自主的攻擊無人機被用於俄烏戰爭中,並由北約支持的軍火商進行測試。今年三月,國防部將 Anthropic 列入黑名單,因為該公司反對其模型被用於自主武器系統——一名聯邦法官上個月將此舉裁定為「違反第一修正案的非法報復」。

這次險些發生衝突的事件,正值 AI 研究人員發出滅絕級警告、引發新一波 AI 安全國家級討論之際,包括來自前沿 AI 實驗室呼籲的監管與協調研究「節奏」。


為什麼這件事重要

這不是普通的「AI 出了包」事件,而是一場險些把世界推向核武邊緣的真實事故。情報分析這種工作本質上需要極高的精確度,因為決策者會把分析結果轉化為軍事行動。當 LLM 在這種關鍵環節「編造」出船上的貨物內容,整條決策鏈就建立在沙堆上。

更值得警惕的是美軍的 AI 採用速度。國防部一月才剛推出「AI 加速策略」,六月就已有 150 萬人在使用內部生成式 AI 工具。從導入到出事,整個循環不到一年。

而 2023 年那份國務院《負責任的軍事使用 AI 宣言》強調的「人類在決策迴路中」原則,在這次事件中顯然失靈。一個聊天機器人憑空生成的貨運清單,居然差點讓美軍動用空中力量在公海上攔截中國船隻——這個後果的不可逆程度,遠超過一般人對「試用新工具」的容忍範圍。

  • 這是已知 LLM 幻覺問題首次在戰爭邊緣被實證
  • 國防部內部流程明顯還沒為 AI 編造內容做好風險控管
  • 「人類在決策迴路中」原則形同具文
  • 事件發生在美中關係高度緊張時段(與伊朗戰爭期間),誤判機率被放大

數據解讀與質疑

150 萬名現役人員使用過軍方 AI 工具這個數字值得拆解:

  • 這是「用過」而非「依賴」——但任何 AI 工具一旦進入日常流程,依賴幾乎是必然的下一步
  • 一個分析師在情報鏈中用 AI 分析船隻貨運清單,這個使用情境本身就已經踩在「高風險決策」紅線上
  • CNN 引述「四名熟悉此事件的消息人士」證實情報「完全錯誤」,並稱「幾乎引發戰爭」——這是極嚴厲的內部評價

最大的質疑點:國防部一月推出的「AI 加速策略」明確寫著要「讓所有合適資料供 AI 利用」,但沒有任何對應的「AI 幻覺防呆機制」。把一份 LLM 生成的貨運清單當作攔截外國船隻的依據,這是流程設計問題,不是單一人為疏失。

未來觀察重點

  • 美軍是否會公布內部調查結果?情報鏈中哪個環節最後踩煞車?
  • Anthropic 被列入黑名單後(因反對自主武器),Claude 是否仍在這次事件中被使用?
  • GenAI.mil 平台(Gemini + Grok on AWS)是否會新增「高風險決策警示機制」?

從律師用 ChatGPT 寫假案例被法院制裁(2023)、到警察用 AI 寫虛構報告被開除(2024)、再到今天美軍差點用 AI 假情報登上中國船艦——AI 幻覺的危害曲線正在向「不可逆決策」的方向攀升。這次沒出事,不代表下次也不會。


資料來源

網友熱門留言 (5)

#1 drtgh ▲ 188
把 LLM 幻覺叫做『幻覺』根本是太含蓄的說法——它就是一種『被允許發生的錯誤』。當上下文越大、索引精度越低,錯誤機率就越高。國防部明知這種技術會出錯,還把它的輸出接到指揮系統、接到網路,最後的下一步大概就是『一枚飛彈殺了我老婆』之類的事。
#2 jmward01 ▲ 142
歷史上美國用『幻覺式情報』發動戰爭的案例一大堆,伊拉克 WMD 就是經典。我個人已經對美國情報完全失去信任——為了政治目標而『找目標』的壓力太大,把決策藏在黑盒子裡、不讓操作者質疑,最後只會養出系統性腐敗。AI 並沒有改變這件事,只是讓它看起來更精緻、更難識破。
#3 jameson ▲ 97
這件事讓我想到 1983 年的蘇聯軍官 Stanislav Petrov——當年蘇聯預警系統誤報美國發射四枚 ICBM,他選擇不上報上級,拯救了世界。今天美軍的 AI 反而差點變成『觸發按鈕的那個人』,歷史還真是諷刺。
#4 simonw ▲ 86
這完全是可預見的災難。2023 年律師用 ChatGPT 寫法庭文件搞出假案例時,我還天真以為這會成為其他領域的警鐘。看來美國情報圈並沒有從律師界的慘劇學到任何教訓——我也不敢押注他們這次會學乖。
#5 faxmeyourcode ▲ 64
這就是 AI 終結人類的方式——不是超智慧出來把我們當電池,是我們假裝它『中等聰明』,於是根據錯誤資訊做了不可逆的決策,等大家發現真相時已經來不及了。