← AI 動態 The Decoder

輝達開發兆級參數開源模型,中國AI規模已超車

輝達正開發擁有破兆參數的開源模型 Nemotron 4。儘管輝達投入巨資,中國的月之暗面與 DeepSeek 卻早已突破此規模,顯示中美大模型參數競賽正持續白熱化。

大型語言模型 開源模型 Nvidia
輝達開發兆級參數開源模型,中國AI規模已超車

輝達(Nvidia)不僅是 AI 晶片的霸主,近期也積極投入自家開源模型的研發。據報導,輝達正在開發名為 Nemotron 4 的大型語言模型,其最大版本的參數將高達一兆,是上一代 Nemotron 3 Ultra 的兩倍。為了支持這項龐大的計畫,輝達甚至將其雲端運算預算提高了三倍,達到 280 億美元,展現其在軟體模型領域的雄心。

然而,在模型參數規模的賽道上,中國的 AI 實驗室似乎走得更前面。例如月之暗面(Moonshot AI)的 Kimi K3 模型已高達 2.8 兆參數,而 DeepSeek V4 Pro 也有 1.6 兆參數,雙雙超越了輝達 Nemotron 4 的目標。這顯示出,雖然輝達掌握了運算硬體優勢,但中國開發者在推動模型參數規模極限上也不遺餘力。

對一般大眾而言,這場「兆級參數」的軍備競賽意味著未來我們將能使用到理解力更深、邏輯更強的 AI 工具。開源模型的競爭也將打破少數科技巨頭的壟斷,讓更多企業與個人能免費獲得世界頂級的 AI 能力,加速各行各業的創新與應用。