
知名人工智慧公司OpenAI近日提出嚴重指控,直指中國AI新創公司Moonshot策劃了一場大規模的「模型蒸餾」活動。該活動企圖從OpenAI的模型中提取受保護的推理能力,藉此用來訓練、複製或改進其競爭對手模型。ChatGPT開發商表示,這項惡意活動始於今年7月初,並在7月24日至25日期間達到高峰,當時有來自4,000個不同用戶的16,000次請求,精心策劃了一套數據提取模式。到了7月28日,參與此行為的用戶帳號更暴增至15,000個。
繞過加密機制操縱互動,涉嫌違反服務條款
這些惡意用戶的手段相當狡猾,他們會先從某個對話中複製經過加密的推理過程,接著要求模型解密並轉錄出隱藏的推理內容。OpenAI在週三的官方部落格中澄清,這些操作者並沒有破解加密機制、入侵資料庫,或是直接取得儲存的用戶對話。相反地,他們透過操縱模型的互動方式,以一種有組織且具規模的手法,讓受保護的推理過程重現在請求者眼前,這項行為已嚴重違反了平台的服務條款。雖然OpenAI無法確定這是單一行為者使用多個帳號,還是由多個潛在行為者共同發起,但他們強調,絕大部分的活動都可以追溯到開發Kimi聊天機器人的Moonshot。
模型蒸餾非個案,多家中國科技巨頭遭點名
這類被稱為「模型蒸餾」的攻擊手法,不僅僅針對OpenAI。另一家知名AI企業Anthropic先前也曾出面指控,點名多家總部設於中國的科技公司涉及類似的竊取行為,其中包括了DeepSeek、小米、Moonshot以及阿里巴巴(BABA)等知名企業。這顯示出透過不正當手段獲取先進AI模型技術的現象,在業界已經成為一個不容忽視的系統性問題,引起美國科技界的高度警戒。
川普政府擬祭制裁,美財長稱中國模型有水印
針對中國企業的行為,美國政府已經準備採取強硬立場。美國財政部長史考特·貝森特在7月份就曾明確表示,如果查證屬實,確認中國模型確實從美國模型中進行了技術蒸餾,川普政府將有權對中國的開源權重模型實施制裁。他當時強調,美方在許多中國模型上發現了美國大型語言模型的水印,這種情況是絕對無法接受的,並承諾會在未來幾天或幾週內密切關注這項議題。
攻擊手法日益複雜,承諾持續強化防禦機制
面對日益嚴峻的技術竊取威脅,OpenAI計畫積極調整策略,以防範未來可能發生的大規模蒸餾活動,並預期這類惡意行為將會持續增加。OpenAI指出,隨著前沿模型的不斷進步,加上行為者積極尋求更廉價的方式來模仿先進能力,未來的對抗性蒸餾嘗試勢必會變得更加複雜。為此,要有效防禦這類活動,將需要依賴多層次的控制機制以及持續不斷的技術適應與升級。

我的網誌