← AI 動態
The Decoder
Google推出Gemini機器人模型,打造通用智慧大腦
Google 發布 Gemini Robotics 2 模型,完美結合影像、語言與動作控制。它能作為機械臂到人形機器人的通用大腦,讓機器人輕鬆理解環境指令並執行複雜任務。
Gemini Robotics 2
多模態AI
機器人技術
Google DeepMind 推出的 Gemini Robotics 2 是一款先進的「視覺-語言-動作 (VLA)」模型。有別於傳統機器人只能執行預先寫好的單一程式,這款模型讓機器人具備了看懂真實環境、聽懂人類指令以及精準執行動作的綜合能力。這就像是幫機器人裝上了一個高階的「智慧大腦」,無論是簡單的桌上型機械臂,還是關節複雜的人形機器人,都能透過這套系統來驅動。
這項技術的突破在於打破了過去機器人軟硬體之間的整合壁壘。Gemini Robotics 2 能夠處理全身協調運動、執行精細的動作任務,甚至能同時指揮並協調多台機器人合作。這代表 AI 已經不再僅限於螢幕內的文字對話或影像生成,而是正式擁有與真實物理世界互動的強大能力。
對於一般大眾而言,這意味著「萬能機器人管家」的夢想又向前邁進了一大步。未來,無論是工廠裡的自動化生產、居家環境的日常清潔與長照陪伴,或是危險環境的救災工作,配備此模型的機器人都能更靈活地適應人類的真實生活場景,成為真正懂你需求的實體好幫手。