據了解,美國財政部長貝森特曾在7月時將蒸餾稱作盜竊,並威脅要對利用這一手段從美國自研模型中汲取技術能力的海外公司實施制裁。
黃仁勳美國時間周一接受CNBC節目《財經早間(Squawk Box)》訪問,當被問到模型蒸餾算不算掠奪時,他說,「這叫做競爭。(That's called competition)」
🔗 延伸閱讀《「AI教父」指AI有10%機率終結人類文明 黃仁勳指此類言論「不負責任」》
🔗 延伸閱讀《AI恐威脅人類生存 蓋茲稱足以殺死10億人、教宗警告「非人化」風險》
指競爭可讓所有事物變得更好
報導指出,他說,「你完全可以盡情測試別家的產品,也有企業為了弄清楚輝達產品的工作原理,把輝達的產品拆解到幾乎只剩骨架。我當然不希望他們這麼做,我希望沒有任何人研究借鑒我們的產品,讓我們一路順利發展下去,但說實話,競爭會讓所有事物變得更好。」
黃仁勳強調,「如果你不喜歡這種情況,不想別人使用你的產品,你只需要了解自己的客戶,把對應的服務關閉就好了。」
本月稍早時,美國網路安全與基礎設施安全局指責中國AI企業正在進行工業規模的知識蒸餾行動,此舉違反美國企業的用戶服務協議。
Anthropic 也說公司發現開發千問(Qwen)系列模型的阿里巴巴以及深度求索(DeepSeek)兩家企業都存在「非法蒸餾」行為。中國方面則駁斥上述指控。
AI蒸餾提供一條不同技術路徑
AI蒸餾是建立在目前AI基本現實之上,尤其性能最強的AI模型,往往是最昂貴、也最難部署的。目前主流的大型語言模型系統,通常擁有數十億甚至數千億個參數,例如OpenAI與Anthropic開發的模型,之所以能夠處理複雜語言任務,很大原因依賴於龐大算力與高階晶片支撐,其訓練與運行成本極高。
BBC之前報導,AI蒸餾提供一條不同的技術路徑,它的核心原理,是用一個性能強大的「教師模型」,對大量任務生成結果,再用輸出的結果來訓練一個較小的「學生模型」,與傳統大語言模型訓練方式不同,「學生模型」不僅學習正確答案,還會學習「教師模型」對不同答案的判斷方式。
舉例來說,在傳統訓練中,AI模型只需判斷一張圖片是貓還是狗,但在蒸餾過程中,模型會學習更細緻的機率分布,例如「80%是貓、15%是狗、5%是其他動物」,這種資訊能幫助「學生模型」掌握更完整的決策邏輯。



