← AI 動態 The Decoder

OpenAI 發佈 GPT Transcribe,語音識別ModelError率仍落後

OpenAI 發佈兩款新語音識別模型 GPT Transcribe 和 GPT Live Transcribe,錯誤率雖有所改善,但仍落後於 ElevenLabs、Google 和 Mistral

語音識別 GPT Transcribe OpenAI
OpenAI 發佈 GPT Transcribe,語音識別ModelError率仍落後

OpenAI 近日發佈了兩款新語音識別模型 GPT Transcribe 和 GPT Live Transcribe,分別適用於預錄音頻文件和實時語音流的識別。GPT Transcribe 的錯誤率為 3.31%,比其前身 GPT-4o Transcribe 改善了 0.7 個百分點,同時價格降低了 25%。然而,根據 Artificial Analysis 的測試,GPT Transcribe 的錯誤率仍然高於 ElevenLabs、Google 和 Mistral 的模型。這些模型的發佈對語音識別技術的發展具有重要意義,可能會在各個領域中得到廣泛應用,例如客服、醫療和教育等。語音識別技術的進步可以提高人機交互的效率和準確性,改善用戶體驗。