← AI 動態
The Decoder
谷歌Gemma 4模型獲得更新,提升性能和穩定性
谷歌的開源AI模型Gemma 4獲得了一個更新,提高了Nvidia Hopper GPU上的性能,修復了工具呼叫的bugs和回應被截斷的問題
AI
Gemma 4
Nvidia Hopper GPU
谷歌的開源AI模型Gemma 4最近獲得了一個更新,該更新主要目的是提高模型在Nvidia Hopper GPU上的性能,同時修復了一些已知的bugs。根據谷歌的說法,啟用Flash Attention 4可以提高模型處理輸入提示的速度,提升幅度在25%至70%之間。此外,時間到第一個token的延遲也降低了最多31%。此外,谷歌還修復了工具呼叫的bugs,工具呼叫是一個允許模型觸發外部工具的功能。這個更新對於Gemma 4的使用者來說是非常重要的,因為它可以提高模型的性能和穩定性,從而更好地支持各種應用。這一事件也反映了AI技術的快速發展和企業對於AI模型的不斷改進和優化。這對於AI的發展和應用具有重要的意義,特別是在生成式AI和NLP等領域