挑戰中國霸權!輝達「這款開源模型」規模將破兆

AI晶片一哥輝達(Nvidia)全力押注開源領域,11日發表開源模型「Nemotron 3.5 Lightning」,主打電腦單一GPU即可運行AI代理的「輕量級」應用。同時據傳輝達正在加緊打造新一代模型「Nemotron 4」,最大版本參數量可望突破1兆,挑戰中國在該領域的霸權。
區塊鏈媒體《BlockTempo》引述外媒消息報導,Nemotron 4尚未完成最終訓練,正式發布時間也還未敲定,但預計落在今年秋季尾聲。目前輝達的Nemotron 3分成三種總參數規模,Nano總參數約300億,單次最多啟用30億;Super總參數約1000億,單次最多啟用100億;最大尺寸Ultra則有約5000億參數,單次最多啟用500億。
三款模型皆採用混合專家架構(MoE)。模型內部就像配置了一群不同專長的「專家」,每次執行任務時只會叫醒其中一部分,不必讓整個模型全數運轉,因此能用較少的運算資源,支撐更大的參數規模。至於Nemotron 4最大版本參數量預估至少達1兆,較Nemotron 3 Ultra的5000億翻倍。
輝達生成式AI副總裁Kari Briski表示,公司投入Nemotron,是因為每個國家、每家企業都需要能夠取得的前沿開放模型,藉此強化安全並加速創新。回到輝達本身,開源攸關AI生態系的主導權,因為開源模型降低企業與開發者使用AI的門檻,反而有機會擴大整體市場,帶動更多GPU算力需求。執行長黃仁勳(Jensen Huang)日前受訪時即直言:「免費的AI對硬體來說應該很好。免費的AI對晶片來說應該很好。」
不過,中國已全面主導開源市場,輝達需要急起直追。比如DeepSeek今年4月發布V4預覽版,其中V4-Pro總參數達1.6兆,單次最多啟用約490億;較輕量的V4-Flash總參數也達2840億,單次最多啟用約130億。同時阿里巴巴的千問(Qwen)系列連兩年在同類型當中,下載量居冠,狠甩Meta的Llama。月之暗面(Moonshot)的Kimi K3,以划算價格提供堪比美國頂級模型的性能。1兆對上1.6兆,輝達確實在參數規模落後中國對手,但AI模型競爭並非只比誰的參數更多。報導分析,關鍵可能落在輝達能否迅速把「夠大」的模型變成「真正好用」AI工具。
在「好用」方面,輝達已踏出關鍵一步。自從黃仁勳在開源AI論戰當中表態力挺,輝達於11日發布首部開源模型「Nemotron 3.5 Lightning」。這款模型主打輕量化,透過模型蒸餾技術降低運算需求,一般筆電或桌上型電腦只要搭載單一GPU即可運行,讓AI代理不必仰賴大型資料中心就能執行。
Nemotron 3.5 Lightning已在開源社群Hugging Face免費開放下載,並針對可在背景自主執行任務的AI代理進行優化。目前資安大廠CrowdStrike、程式碼審查工具CodeRabbit,以及法律AI助手Harvey等企業,都已開始測試這款模型。輝達還同步推出NeMo Switchyard開源路由工具,能依照不同任務選擇適合的AI模型。從兆級模型到單一GPU即可運行的AI代理,輝達正把開源布局一路延伸到實際應用。面對DeepSeek、Qwen及Kimi等中國模型持續追趕,Nemotron系列能否擴大輝達在開源AI市場的影響力,值得後續觀察。
三立新聞網提醒您:
內容僅供參考,投資人於決策時應審慎評估風險,並就投資結果自行負責。
投資一定有風險,基金投資有賺有賠,申購前應詳閱公開說明書。