研究與評測
路透:中國軍事研究以 GPT-3.5、Claude 3 Haiku 蒸餾模型,部署無人機與海戰模擬
INSIDE單一來源
尚未逐項核實
目前依單一來源整理,這是來源數量描述,不是對消息真假的判定。

《路透社》檢視超過 80 篇中國學術論文與專利後報導,與中國人民解放軍及其他軍事機構有關的研究人員,曾利用 OpenAI、Anthropic 等美國企業的 AI 模型進行模型蒸餾,訓練可在軍方內部網路、無人機及戰術設備運作的中國模型。相關資料包括詹姆斯敦基金會彙整的研究;該基金會研究員 Sunny Cheung 分析超過 60 篇論文,認為中國軍事科學家正有系統地擷取西方模型的推理步驟,《路透社》另驗證並找出約 24 個軍方相關案例,應用涵蓋軍事軟體原始碼處理、網路戰、社群監測、無人機導航及海上目標辨識。中國人民解放軍 96941 部隊研究人員去年發表的論文顯示,團隊先以 GPT-3.5 摘要敏感軍事軟體原始碼,再用摘要訓練中國模型,使最終系統可完全在軍方內部網路運作。與中國武器工業關係密切的中北大學,也曾以 Claude 3 Haiku 產生合成訓練資料,訓練用於社群媒體監測與內容管理的文字分類模型。Anthropic 表示,公司未在中國提供 Claude 的商業使用管道,也未向北京控制的企業提供服務,並以監測系統偵測違反政策的行為;該公司警告,蒸餾模型可能取得原始系統的敏感能力,卻未繼承安全防護。中國人民解放軍國防科技大學 2024 年論文則描述,研究人員將蒸餾縮減後的影像處理模型部署於無人機,使其在通訊中斷時仍可即時分析影像,協助導航與選定目標。中國人民解放軍軍事科學院今年稍早發表的研究,也把蒸餾後的目標辨識模型安裝於戰術硬體,並用於涉及無人機、船艦及無人潛艦的模擬海上行動。報導指出,美方爭議焦點是部分中國實體可能未經授權擷取美國模型能力,削弱先進晶片出口管制或涉及智慧財產權;中國否認相關指控,批評美方追求「AI 霸權主義」,並稱美國企業也曾採取類似做法。中國人民解放軍陸軍工程大學研究人員今年 1 月另發表論文,分析透過公開輸出反向解析模型能力的「無資料蒸餾」風險,並提出遮蔽輸出中隱藏邏輯資訊的防禦機制。
讀原始報導背景
知識蒸餾(knowledge distillation)是人工智慧領域的一種模型訓練技術。這項技術的核心概念與「將知識從一個模型轉移至另一個模型」有關。