Nvidia也開源了:一張GPU能跑、商用全免費的Nemotron 3.5 Lightning

Nvidia也開源了:一張GPU能跑、商用全免費的Nemotron 3.5 Lightning

「Free AI應該對硬體有利,Free AI應該對晶片有利。」這是Nvidia執行長Jensen Huang對「開源AI」的解讀角度——不是慈善,是生意。8月11日,Nvidia發布了自己的開源模型Nemotron 3.5 Lightning,這是Huang今年7月24日高調表態支持開放權重模型以來,公司交出的第一個開源模型。

一顆GPU就能跑,還是免費商用

Nemotron 3.5 Lightning總參數量300億,但採用混合專家(MoE)架構,每次推論只會動用其中30億個參數,因此可以在一張消費級GPU(筆電或桌機等級)上運行。這個模型是用蒸餾技術,從Nvidia更大型的Nemotron 3 Ultra模型「濃縮」而來,而且商用完全免費。效能方面,Nvidia宣稱它的輸出速度比同級開源模型快上最多4倍,任務完成速度快了約30%;如果搭配Anthropic的Opus 4.8混合使用,可以把整體任務完成成本壓到單獨用Opus的三分之一左右。Nvidia同時也發布了NeMo Switchyard,一套會自動幫每個任務挑選「最合適、最划算」模型的路由工具。

三週前才公開表態,這次是說到做到

這次發布並不是憑空出現的。7月24日,Huang在X上發出他在該平台的第一篇貼文,內容是一封產業公開信,呼籲美國政府不要限制開放權重AI模型的發展;這封信一開始只有25個連署單位,短短幾天內成長到超過150個組織連署。信裡的論點也很直白:開放模型能「強化安全與資安、加速創新與擴散、並促成(各國的)技術主權」。這次Nemotron 3.5 Lightning的發布,等於是把三週前那封公開信的立場,直接兌現成一個真正可以下載、可以商用的模型。

晶片生意才是背後的算盤

Huang自己說得很清楚:免費、開放的AI模型能拓寬更多人接觸AI技術的門檻,而這件事本身會「推升公司核心業務——用來訓練與執行AI系統的GPU——的需求」。換句話說,Nvidia推廣開源模型,邏輯上跟賣鏟子的人鼓勵大家挖礦是同一套劇本:模型越開放、用的人越多,需要的算力就越多,而算力,正好是Nvidia在賣的東西。