← AI 動態 The Decoder

六週推三款平價模型!Gemini 3.8 Flash 強化程式與資安

Google 於六週內發布第三款平價模型 Gemini 3.8 Flash,程式能力大增。但因採用複雜推論機制會消耗更多 Token,實際運算成本可能不減反增。

Google Gemini 大型語言模型 成本控管
六週推三款平價模型!Gemini 3.8 Flash 強化程式與資安

Google 近期在 AI 語言模型的策略上轉向了「平價且快速迭代」路線。繼三週前的版本後,Google 再次推出 Gemini 3.8 Flash,這是短短六週內發布的第三款輕量級預算模型。這次更新包含兩個版本:主打推理與程式編寫的通用模型,以及專注於資訊安全的 3.8 Flash Cyber 專屬版本。

儘管定位為平價型號,Gemini 3.8 Flash 在程式開發能力上有顯著突破,部分代理程式基準測試甚至能與對手的旗艦模型相抗衡。然而,雖然字面定價不變,但它採用了更努力思考的推論機制,處理單一任務時會多消耗約 30% 的輸出 token,這讓實際使用的整體成本反而比上一代更高。

這項發布引起了業界的不同解讀,展現了輕量模型開發效率的同時,也讓人好奇 Google 的下一代旗艦模型是否進度落後。對一般開發者或企業而言,未來在導入這類「平價模型」時,更需要精算背後的隱藏 token 消耗量與真實成本,不能僅依賴表面的定價標籤。