← AI 動態
The Decoder
黑森林實驗室推出Flux 3,創新生成長達20秒的原生音頻視頻
黑森林實驗室的Flux 3是一種多模態基礎模型,可以學習圖像、視頻和音頻,並生成長達20秒的原生音頻視頻
多模態基礎模型
生成式AI
視頻生成
黑森林實驗室的Flux 3是一種多模態基礎模型,可以同時學習圖像、視頻和音頻。它可以生成長達20秒的原生音頻視頻,並具有文本到視頻和連接個別片段的功能。此外,該公司還開發了Flux-mimic,一種適用於機器人應用的視頻動作模型,目前正在奧迪公司進行測試。這項技術的重要性在於它可以讓機器更好地理解和生成多模態數據,並具有廣泛的應用前景。對於一般人來說,這項技術可以用於創作、娛樂和教育等領域,提高人機交互的體驗和效率。