← AI 動態 The Decoder

谷歌的DiffusionGemma:不需要從頭開始訓練就能建立文本擴散模型

谷歌的DiffusionGemma模型可以在不從頭開始訓練的情況下,使用不到10%的原始訓練預算,生成256個令牌的文本

文本擴散模型 生成式AI 谷歌
谷歌的DiffusionGemma:不需要從頭開始訓練就能建立文本擴散模型

谷歌的DiffusionGemma模型是一種文本擴散模型,通過對Gemma 4模型進行改造,實現了使用不到10%的原始訓練預算,生成256個令牌的文本。這種模型可以在Nvidia H100加速器上達到每秒1500個令牌的速度。這項技術的重要性在於,可以減少訓練時間和成本,同時提高生成文本的效率和質量。對於一般人來說,DiffusionGemma模型可以應用於自然語言生成、文本摘要等領域,提高人機交互的效率和準確性。