← AI 動態 The Decoder

OpenAI推出極速模式,GPT-5.6生成速度狂飆14倍

OpenAI 攜手 AI 晶片廠 Cerebras 推出「極速模式」,讓 GPT-5.6 模型生成速度提升達 14 倍,每秒產出 750 個 Token,大幅解鎖即時 AI 應用。

OpenAI Cerebras 模型推理
OpenAI推出極速模式,GPT-5.6生成速度狂飆14倍

OpenAI 宣佈針對旗艦模型 GPT-5.6 Sol 推出全新的「極速(Ultrafast)」推理模式。這項升級得益於 OpenAI 與 AI 晶片廠 Cerebras 的百億美元合作,讓模型每秒能生成高達 750 個 Token,速度比以往快上 14 倍。未來 API 計價將分為「標準」、「快速」與「極速」三個層級,目前初期僅限部分客戶進行預覽。

這項技術突破極為關鍵。過去使用生成式 AI 最大的痛點就是「等待時間」。當 AI 的回覆速度達到每秒 750 個 Token 時,已經遠超人類的閱讀速度,幾乎能實現真正的「零延遲」互動。這不僅能讓語音助理的對話變得宛如真人般自然,更將解鎖許多需要即時反應的商業場景,例如即時多語翻譯與高頻自動化數據分析。

對一般大眾而言,雖然初期功能僅針對開發者開放,但未來隨著這項技術逐漸普及,我們日常使用的各式 AI 服務將不再需要轉圈圈等待。這標誌著大型語言模型的發展,已經正式從「算得聰明」邁向「算得又快又好」的新里程碑。