← AI 動態 The Decoder

中國首次成功訓練1.6萬億參數AI模型,不需要Nvidia

中國公司美團成功訓練了一個1.6萬億參數的AI模型,沒有使用Nvidia的晶片

AI 中國 Nvidia

中國公司美團宣布成功訓練了一個1.6萬億參數的AI模型,名為LongCat-2.0,這個模型是在中國自主研發的晶片上訓練的,沒有使用Nvidia的晶片。這個成就表明中國現在有能力在國內計算集群上訓練大規模的AI模型。LongCat-2.0在一些基準測試中甚至超越了西方領先的模型。這個模型的訓練使用了超過5萬個國產AI ASIC晶片,處理了超過35萬億個token。這個成就對於中國的AI發展具有重要意義,表明中國在AI技術上具有自主研發的能力。