- 路透揭中國軍方利用「模型蒸餾」偷師美國AI
- 研究人員用OpenAI等模型輸出訓練本土國防系統
- 解放軍96941部隊曾用GPT-3.5處理軍事原始碼
- 美方指控違反出口管制及智財權,中方駁斥為霸權主義
- 專家指蒸餾模型能力仍不及原始模型[3]
(綜合中央社、自由時報等3家媒體報導)
路透社審閱逾80篇中國學術論文與專利資料,並結合華府智庫詹姆斯敦基金會(Jamestown Foundation)的研究,揭露中國軍事研究人員廣泛利用「模型蒸餾」(model distillation)技術,從OpenAI、Anthropic等美國頂尖AI公司的模型中提取能力,訓練本土系統,以強化國防、監控及網路戰能力。
報導指出,儘管華府試圖限制北京取得高階晶片等戰略技術,中國軍事及安全相關機構仍透過此方式「抄捷徑」,無須從零開始建構前沿AI所需的龐大運算資源。爭議核心在於未經授權的攫取行為,而非蒸餾技術本身。
分析逾60篇論文的詹姆斯敦基金會研究員張崑陽表示,中國軍方科學家正系統性地掌握西方模型的推理邏輯,將其改造用於監控、網路戰及戰術決策。他說:「教一個模型正確答案是一回事,教導它答案背後的推理過程則要困難得多。」
路透社另確認20多件與軍方有關的案例研究。其中一篇去年發表的論文顯示,負責軍事情報與網路戰的解放軍96941部隊研究人員,利用OpenAI的GPT-3.5處理敏感軍事原始碼。為克服第三方模型不宜處理機密資訊的限制,研究人員用GPT-3.5生成軟體程式碼摘要,再以此訓練本土模型,使其完全在軍方內網運行。
此議題已成為美中AI治理對話的重大爭議點。美方官員指控此舉可能違反出口管制並侵害智慧財產權;中國方面則駁斥相關指控,稱華府行徑屬AI「霸權主義」,並指美國業者也有類似作為。白宮、五角大廈、中國外交部、解放軍及OpenAI皆未回應置評請求。
AI資料公司Sapien共同創辦人柯維科指出,蒸餾模型的能力仍不及原始模型,此技術「是把挑選過的能力轉移至較為廉價且受本地控制的系統,而不是從前沿AI中獨立成型」[3]。
本事件已沉寂,相關脈絡見「相關事件」