首頁 -> 頭條

“AI蒸餾”是何物?美方指控中國意欲何為?

分享到:
2026-09-10 09:05 | 稿件來源:香港新聞網

【字號:

香港新聞網9月10日電 9月8日,美國聯邦調查局(FBI)、國家安全局(NSA)以及網絡安全與基礎設施安全局(CISA)聯合發佈所謂網絡安全公告,無端指責中國頭部AI企業針對美國前沿大模型開展“工業規模蒸餾”活動。事件曝光後,中國商務部、外交部先後作出正式回應,指出美方相關指控毫無事實與法律依據,本質是將全行業通用的中性技術政治化,維護自身科技霸權與算力壟斷地位。

資料圖:2025年2月17日,用戶在DeepSeek手機客戶端上提問。新華社照片

事件始末:美三家核心安全機構聯合發佈指控公告

綜合美媒公開報道,美國三大安全機構在9月8日的聯合安全公告中,點名深度求索(DeepSeek)、月之暗面(Moonshot AI)、阿里巴巴、MiniMax、階躍星辰(StepFun)和智譜(Z.AI)6家中國頭部AI研發企業,聲稱這些企業正在使用蒸餾技術,“提取美國前沿AI模型受保護的專有功能與能力”。

公告刻意放大技術行為的戰略屬性,宣稱“此類行動的龐大規模與複雜手段表明,蒸餾并非這些企業AI模型研發的輔助手段,而是其至關重要的核心”,還聲稱中國AI企業通過這類活動,能够顯著縮短AI開發周期,大幅降低訓練前沿模型所需的資金投入。

公告中提及的被“針對”的美國AI模型,覆蓋Anthropic的Claude、OpenAI的ChatGPT、谷歌的Gemini和xAI的Grok等當前美國主流前沿大模型。

事實上,美方針對“AI蒸餾”的炒作早已持續近一年:2025年1月OpenAI率先指責DeepSeek“不當基於ChatGPT構建其模型”,今年2月Anthropic聲稱三家中企策劃“工業規模蒸餾攻擊”,4月白宮科技政策辦公室將相關問題列為聯邦機構重點關注事項,7月美國財長貝森特直接威脅要對相關中國企業實施制裁,本次三家核心安全機構聯合發佈公告,是美方這一系列動作的集中升級。

圖片來源:中國外交部官網

中方:指控無事實與法律依據

針對美方的無端炒作,中國外交部發言人毛寧9月9日在例行記者會上表示,中國人工智能的發展是高水平科技自立自強的成果,也得益於始終秉持共商、共建、共享和開放合作的理念。中方始終認為,各方應當加強合作,推動人工智能開放包容、普惠、向善發展,服務全人類的福祉。希望美方能够認真地落實兩國元首達成的重要共識,不要對中國進行不實的指責和抹黑。中美都是人工智能大國,應當加強合作。

同日,中國商務部新聞發言人也表示,相關指控既無事實依據,也缺乏法律支撐。蒸餾是全球通行的中性技術手段,中美企業均普遍使用。美方將其政治化、工具化,暴露雙重標準,實為維護科技霸權與算力壟斷。中方堅持開源開放、合作共贏,願在平等基礎上開展政府間對話,但若美方執意打壓,中方必將堅決反制。

7月19日,參觀者在中科曙光展台拍攝展品全國產十萬卡AI超集羣——曙光8000(登峯)。新華社照片

技術溯源:蒸餾是全球AI行業通用中性技術

據悉,從技術定義來看,“蒸餾”全稱為知識蒸餾(Knowledge Distillation),由深度學習專家Geoffrey Hinton等人在2015年正式提出,核心採用“教師-學生”架構,把大模型(教師)的知識通過軟標籤(概率分布)遷移到小模型(學生)身上,區別於傳統的0/1硬標籤分類模式。

這項技術的核心價值,是用大模型生成的數據訓練輕量化小模型,在大幅降低計算成本的同時,讓小模型獲得接近大模型的性能,適配移動端部署、實時推理等多元落地場景。

經過十餘年的行業迭代,目前該技術已經從基礎的輸出層蒸餾,發展出特征蒸餾、關係蒸餾、自蒸餾等多個成熟分支,是主流AI企業廣泛使用的核心降本增效技術,本身完全合法合規。

就連美方相關報道也不得不承認,蒸餾技術“在AI行業十分普遍”:蘋果就公開使用蒸餾技術處理自家大模型,得到可直接在手機端運行的精簡版本;Meta首席執行官扎克伯格今年8月也專門發文強調開源AI的重要性,呼籲美國政府“重新審視模型蒸餾和訓練數據使用等方面的政策”,保護模型在研發過程中向其他模型學習的基本原則。

資料圖:2026年2月4日,參觀者經過阿里巴巴雲產品展覽區。新華社照片

專家:美方刻意將技術問題上升至地緣戰略層面

針對美方公告中“蒸餾是中國AI企業研發核心”的荒謬結論,新加坡南洋理工大學校長講席教授、人工智能交叉研究院院長安波直接指出,這一表述完全與公開證據不相符。當前公開的行業數據清晰顯示,一批中國AI企業是在算力受限的條件下實現效率創新,用更少的算力卡、更低的精度、更優化的架構達成與美國前沿模型同等的性能,再進一步把推理成本大幅壓縮,這條技術路線本身就是對“堆算力”傳統研發範式的替代性探索,美方將其整體歸結為“抄近道”,完全無視了大量可驗證的自主研發成果。

復旦大學中國研究院副研究員劉典進一步分析,美方此次動作最值得關注的點,并非再次批評中國AI企業,而是直接把模型蒸餾從企業之間的知識產權、服務條款和商業競爭問題,提升到了國家安全和地緣科技競爭層面。FBI、NSA和CISA三家核心安全機構同時出面,本身就說明美國正在重新定義前沿大模型的屬性:它不再只是普通的商業軟件或互聯網服務,而被美國政府認定為具有極高戰略價值的核心技術資產。

不少美國本土行業人士也對美方的極端操作提出質疑:OpenAI高管迪恩·鮑爾等美國研究人員公開表示,蒸餾技術或許曾在AI競賽早期助推了部分中國企業的發展,但這絕對不是中國AI企業近期取得核心技術進步的主要原因。

部分法律專家也認為,單就蒸餾這一行為本身,未必構成竊取,AI模型的輸出內容很難被視作和書籍、電影同等的知識產權保護對象,就算納入保護範圍,蒸餾者也不是直接複製輸出文本,只是從中學習規律,就像有志寫作的人閱讀書籍積累創作經驗,完全屬於合理的技術學習範疇。

深層動機:美國從“限制算力”轉向“限制能力”

劉典在深度分析中指出,美國真正擔心的從來都不是“蒸餾”這個技術名詞本身。如果中國AI企業能够通過開源技術、蒸餾優化、工程迭代和大規模落地場景,把相近能力的大模型以遠低於美國的成本做出來,那麼美國此前依靠芯片禁運建立起來的技術領先優勢,就很難單純依靠限制算力出口來維持。

這也意味著,美國在AI領域的對華打壓策略,已經正在從“限制中國獲得高端算力”,逐步轉向“限制中國獲得AI核心能力”。美方刻意將全行業通用的中性技術包裝成“國家安全威脅”,本質是為了給自己後續出台更多極端管制措施製造輿論藉口,試圖通過壟斷前沿大模型的技術迭代路徑,長期維持自身在全球AI產業的霸權地位。(完)

【編輯:紀東】

視頻

更 多
“天宮課堂”首次響起廣東話!黎家盈與港澳學生開展“天地對話”
仁者遠行 “一國兩制”傑出貢獻者董建華 
【你不知道的香港】越夜越熱鬧的香港“水果天堂”
香港特區青年赴聯合國任職 李家超:當好超級聯繫人 說好香港故事
“2026特奧融合慈善晚宴”香港舉行 姚明李小鵬方力申等嘉賓出席
【通說環球】大災當前 尼泊爾為何婉拒外國救援隊?
李家超:五年規劃將提長遠策略改善民生 續秉持以民為本施政理念