從矽谷到華盛頓掀起技術爭議:AI「蒸餾」究竟是創新催化劑,還是智財盜竊與國安威脅?
今年早些時候,Google 人工智慧(AI)負責人傑夫·迪恩(Jeff Dean)在一檔 Podcast 節目中,探討了一個當時在科技圈以外幾乎鮮少被提及的概念——「蒸餾」(Distillation)。
當時,迪恩在談到 Google AI 模型的開發歷程時指出,團隊發現了 AI 蒸餾技術的巨大潛力。因為 Google 希望在無需完全仰賴單一龐大圖像識別模型的狀況下,大幅提升整體系統的運作效能。
「透過蒸餾技術——這是讓較小模型能力變強的核心關鍵——你必須先擁有前沿頂尖模型(Frontier Model),才能將其能力蒸餾轉移至較小的模型中。」迪恩在今年 2 月的訪談中這麼解釋。
然而,短短 5 個月後,「蒸餾」一詞卻突然從技術討論圈暴紅,成為從矽谷到華盛頓政治圈最熱門、爭議也最大的核心焦點。科技界人士與美國政策立法者正在展開激烈辯論:這種將大模型精華轉移至小模型的做法,究竟是推動產業創新的技術捷徑,還是正在演變成危害國家安全與智慧財產權的重大威脅?
抄作業還是加速創新?解析 AI 蒸餾技術的核心爭議
從高層次的概念來看,AI 中的「蒸餾」是指利用聊天機器人的回答,或是先進前沿 AI 模型的產出成果,來訓練或優化另一個模型。
這項技術之所以引發巨大爭議,原因在於使用方式的不同。它能讓模型開發者僅透過其他巨頭花費數百萬甚至數十億美元開發出的頂尖訓練成果,就以極低代價打造出具有高度競爭力的 AI 產品。
AI 安全公司 SecurityPal 創辦人普卡爾·哈馬爾(Pukar Hamal)用了一個非常貼切的比喻:
「這幾乎就像有人專心去聽了每一堂講座、讀完所有艱深的教科書,並獨自完成了所有困難的功課。然後另一個學生跑過來說:『嘿,我沒做那些功課,我能直接抄你的作業嗎?』」
儘管如此,AI 產業的絕大多數巨頭卻不認為這是在「抄作業」。
面對日益高漲的監管壓力,包含NVIDIA、微軟(Microsoft)、Meta、Palantir 以及其他 20 多家科技企業,於近期破天荒地聯合發表了一封聯名公開信,明確要求政策制定者避免對開放權重(Open-weight)AI 模型實施「過早的限制」,以免扼殺市場競爭,甚至將本土創新強行推向海外。
這群科技巨頭在聯名信中明確強調:「蒸餾——也就是使用一個模型的輸出來幫助訓練或改進另一個模型的做法——是目前業界廣泛用於模型改進、演進與驗證的正當技術。」
業界分成兩大陣營:效率優先 vs 智財防線
蒸餾技術的快速普及,無疑給美國政策制定者出了一道極難回答的考題。
作為聯名信簽署人之一,雲端儲存與管理公司 Box 執行長亞倫·列維(Aaron Levie)在受訪時表示,為了維持美國企業的全球競爭力,業界必須能夠獲取並利用最優秀的技術,無論這項技術是在哪裡被開發出來的。
「整體趨勢非常明顯,創新越多——無論是來自美國還是其他地方——你就應該期待更多的 AI 技術進步。而且隨著時間推移,AI 應用的整體成本會更低、效率也會更高。」列維指出。
Info-Tech 研究集團研究總監沙希·貝拉姆孔達(Shashi Bhramakonda)也補充說明,雖然目前的討論焦點多半集中在開放權重模型上,但事實上許多企業在打造自家專利模型時,早已深度納入蒸餾技術。例如英偉達在其 Llama Nemotron 系列模型的訓練過程中,就使用了蒸餾技術,相關研究論文中對此有非常詳細的技術描述。
「這是一種完全合法且極具價值的技術,專門用於基於較大模型的輸出成果,來訓練更小、更便宜的模型,且長久以來一直被業界廣泛使用。」貝拉姆孔達表示。
Anthropic 與 OpenAI 的國安警訊與服務條款禁令
然而,身為前沿模型開發領頭羊的 Anthropic 卻抱持截然不同的立場。由於 Anthropic 能清楚監測其模型的存取與使用方式,加上其龐大的商業利益需要捍衛,立場顯得格外堅定。
目前估值已接近 1 萬億美元(1 兆美元)、並積極準備在不久的將來公開上市(IPO)的 Anthropic 明確表示,阻止未經授權的非法蒸餾行為,直接關係到國家安全。
Anthropic 在今年 2 月的官方聲明中表示:「Anthropic 與其他美國科技公司耗費巨資建構安全系統,目的就是為了防止國家與非國家行為者利用 AI 進行惡意活動,例如開發生物武器或執行大規模惡意網路攻擊。」該公司強調,要阻止這種風險,需要產業參與者、政策制定者以及全球 AI 社群之間採取迅速且高度協調的行動。
正因如此,OpenAI 與 Anthropic 雙雙在其服務條款(Terms of Service)中嚴格禁止任何形式的蒸餾行為。貝拉姆孔達分析,這兩家公司實質上是在向市場發出警訊:未經授權使用其大型模型輸出進行訓練,等同於潛在的智慧財產權盜竊行為。
但對廣大企業用戶來說,隨著 AI 算力與訓練成本持續飆升,設法提高營運效率成了唯一的生存法則。
SecurityPal 創辦人哈馬爾表示,在自己的公司內部,他完全不反對使用開放權重模型來自動化安全評估。他透露,這種做法能幫公司節省龐大的營運資金。
「我們當然會確保程式碼中沒有惡意的後門。但在我們完成安全評估後,將經過蒸餾優化的模型託管在我們自己的基礎設施上,何樂而不為呢?」哈馬爾說。
訓練資料權利爭議:AI 巨頭主張智財權的雙重標準?
值得注意的是,當 Anthropic 與 OpenAI 試圖以「智慧財產權盜竊」為由抵制蒸餾時,卻面臨了一個極為尷尬的法理困境——這兩家公司本身就因為未經授權抓取網路大量版權內容來訓練自己的模型,而面臨無數創作者與出版商的版權訴訟。
在多起針對 AI 巨頭的版權集體訴訟中代表知名書籍作者的 Boies Schiller Flexner 律師事務所律師馬克斯·普里特(Max Preete)直言,政府在處理此議題時也陷入了相同的雙重標準矛盾。
「至少從公開層面來看,本屆政府將政策焦點完全放在保護大型科技公司的智慧財產權上;然而對於廣大創作者與個人智慧財產權在未經授權的情況下被科技巨頭隨意使用,政府在很大程度上卻選擇保持沉默。」普里特抨擊道。
從演算法效率提升的技術亮點,演變成科技巨頭戰略防護與政策博弈,AI「蒸餾」技術已不再只是工程師之間的技術術語,而是牽動著全球 AI 產業格局、國家安全防線與法律智慧財產界線的核心戰場。
- 延伸閱讀:智財權大戰開打!美國控中國 Kimi 模型靠蒸餾技術抄襲,擬列入實體清單嚴厲鎖喉
- 延伸閱讀:中國漏洞庫指控 Claude Code 留有安全後門,背後牽扯中美 AI 模型蒸餾防禦戰
- 延伸閱讀:Meta工程師禁用Claude、OpenAI內幕曝光:防堵「模型蒸餾」侵權引火上身
請注意!留言要自負法律責任,相關案例層出不窮,請慎重發文!