← AI 動態 The Decoder

Meta 發布即時語音轉錄模型,打造全天候 AI 助理

Meta 推出 Muse Voice 語音轉錄模型,主打超低延遲並能辨識 20 位發言者。以極具競爭力的價格與多語言支援,將成為打造全天候語音 AI 助理的關鍵基石。

Meta 語音辨識 AI助理
Meta 發布即時語音轉錄模型,打造全天候 AI 助理

Meta 推出名為 Muse Voice Transcribe 的即時語音模型。這項技術的亮點在於能以 80 毫秒的極小片段處理語音,動態調整字詞延遲時間以平衡速度與準確率。它不僅能精準判斷句子邊界,還能在單一系統中分辨多達 20 位不同的發言者,無需依賴其他輔助工具。

這項技術之所以重要,在於它為「全天候待命」的 AI 助理提供了關鍵基礎。在商業佈局上,Meta 開出每小時僅 0.18 美元的破盤價,大幅低於 OpenAI 與 ElevenLabs 等競爭對手。這意味著企業與開發者能以極低成本,將高品質語音辨識技術廣泛導入產品中。

對一般大眾而言,這代表未來我們將迎來反應更靈敏、對話更自然的 AI 助理。無論是跨國會議中的多人即時翻譯與紀錄,或是日常生活中隨時待命的智慧管家,這項支援超過 70 種語言的新技術,都將讓 AI 更無縫且直覺地融入我們的工作與生活。