← AI 動態 The Decoder

首款開源模型登頂!中國MiniMax H3震撼AI影音生成

中國MiniMax開源H3影音生成模型權重,成為首個在評測中登頂的開源模型。H3能整合圖文與聲音,生成帶立體聲的高品質短片,大幅降低進階創作門檻。

影音生成 開源模型 多模態
首款開源模型登頂!中國MiniMax H3震撼AI影音生成

中國AI新創MiniMax近期釋出高達330億參數的「H3」影音生成模型權重,隨即在影片評測中奪下影片編輯類榜首,這也是首次有「開源模型」在AI影音領域中擊敗眾多閉源巨頭,寫下了全新的里程碑。

H3模型最大的亮點在於強大的「多模態」處理能力。它可以同時接收文字、圖片、影片和音訊作為指令(單次最多支援9張圖與多段影音),直接生成長達4到15秒、自帶立體聲的高品質短片。這意味著創作者不需要繁雜的剪輯工具,只需透過簡單的素材輸入,就能快速製作出聲光效果俱全的作品。

對一般大眾與業界而言,H3的開源大幅降低了先進影音AI的取得與應用門檻。無論是個人創作者還是中小型企業,未來都有機會基於這個強大的模型開發出更豐富的應用,預期將引爆新一波AI影音創作熱潮。不過目前其2K高畫質模組仍保留為閉源狀態。