← AI 動態
The Decoder
六週推三款平價模型!Gemini 3.8 Flash 強化程式與資安
Google 於六週內發布第三款平價模型 Gemini 3.8 Flash,程式能力大增。但因採用複雜推論機制會消耗更多 Token,實際運算成本可能不減反增。
Google Gemini
大型語言模型
成本控管
Google 近期在 AI 語言模型的策略上轉向了「平價且快速迭代」路線。繼三週前的版本後,Google 再次推出 Gemini 3.8 Flash,這是短短六週內發布的第三款輕量級預算模型。這次更新包含兩個版本:主打推理與程式編寫的通用模型,以及專注於資訊安全的 3.8 Flash Cyber 專屬版本。
儘管定位為平價型號,Gemini 3.8 Flash 在程式開發能力上有顯著突破,部分代理程式基準測試甚至能與對手的旗艦模型相抗衡。然而,雖然字面定價不變,但它採用了更努力思考的推論機制,處理單一任務時會多消耗約 30% 的輸出 token,這讓實際使用的整體成本反而比上一代更高。
這項發布引起了業界的不同解讀,展現了輕量模型開發效率的同時,也讓人好奇 Google 的下一代旗艦模型是否進度落後。對一般開發者或企業而言,未來在導入這類「平價模型」時,更需要精算背後的隱藏 token 消耗量與真實成本,不能僅依賴表面的定價標籤。