《華爾街日報》8月23日報導,輝達將向AI新創Poolside投資10億美元(約318億元台幣),還將支付60億美元(約1907億元台幣)用於購買其技術授權,並聘用該公司的100多名員工。這些工程師將加入輝達的Nemotron專案,幫助改進其最大、最複雜的開放權重(open-weight)模型。
Nemotron是輝達2023年首次推出,目的在開發開源權重模型。
未來AI「不再是少數人控制的封閉技術」
「開放權重」與「開源」(open-source)模型是最常見的「開放」模型,但有別於開源AI模型把程式碼、架構、文件、訓練方法與部分資料集等對外公開,開放權重AI模型僅釋出已訓練完成的「模型權重」(model weights)供大眾免費下載與微調,並允許用戶根據特定需求進行修改,但通常不會公開其所有訓練資料、程式碼或開發細節。
Poolside的創辦人表示,與輝達的這筆交易將確保未來AI「不再是少數人控制的封閉技術,而是由眾多開放的參與者共同建構」。
如今,透過獲得Poolside的技術授權並吸收其大部分工程人才,輝達押注於明年能夠打造出足以媲美最尖端模型的Nemotron版本。
輝達本月初發布Nemotron 3.5 Lightning,是其開放權重模型的「輕量級」版本,並且正在開發迄今為止規模最大的版本。據傳,該版本擁有超過兆個訓練參數,使其躋身有史以來規模最大的AI模型之列。不過,一些中國開發的開放權重模型規模更大。
🔗 延伸閱讀《輝達傳開發新一代「Nemotron 4」 具1兆參數!挑戰頂尖開源AI模型》
🔗 延伸閱讀《震撼!輝達將砸逾8200億開發開源AI模型 首批最快今年底問世》
輝達挺開放模型挑戰AI巨頭
報導指出,這項授權協議將對OpenAI和Anthropic在內的美國尖端AI公司構成直接挑戰,因為開放權重的運作成本通常更低,且易於自訂。儘管輝達將這兩家大型實驗室視為其最緊密的合作夥伴,但此舉反映執行長黃仁勳致力於同時在多個AI領域取得成功,以確保公司能夠保持其市場主導地位的努力。
黃仁勳長期支持開放權重模型,但美國AI產業把更多資源投入專有或「封閉」的AI模型,OpenAI的ChatGPT、Anthropic的Claude及Google的Gemini都是閉鎖式AI模型,其原始程式碼與數值權重設定皆不對外公開,使用上通常需付費並受嚴格的授權條款約束。
美中AI爭霸:開放生態系成關鍵
美國AI實驗室未優先考慮開源模型,引發各界擔憂世界各地的企業和國家可能會轉而使用中國的開源權重模型。黃仁勳在社群媒體X平台發表首篇文章,以《開放權重與美國AI領導地位》為題,文中指出,美國能否贏得AI競賽「並非取決於某一個尖端AI模型,而是取決於美國能否構建一個強大、開放的生態系,並將其普及到各個領域」。
中國DeepSeek於2025年1月發布首個低成本開放權重模型時,曾引發美國科技股的暴跌,因為投資者將其解讀為中國模型有望趕上甚至超越美國AI技術的證據。創投家安德森(Marc Andreessen)當時就稱之為AI領域的「人造衛星時刻」。此後,美中AI之爭持續不斷,中國湧現出新的參與者,建構的開放模型僅比美國尖端AI技術落後幾個月,包括月之暗面(Moonshot)的Kimi和Z.AI的GLM系列模型等。


