← AI 動態 The Decoder

谷歌Deepmind將AI代理視為內部威脅

谷歌Deepmind的新框架將AI代理視為潛在的內部威脅,並根據行為進行授權

AI安全 Deepmind AI控制路線圖
谷歌Deepmind將AI代理視為內部威脅

谷歌Deepmind的新框架「AI控制路線圖」不再盲目信任AI代理,而是將其視為潛在的內部威脅。這個框架根據AI代理的行為進行授權,並且已經分析了一百萬個編碼任務,發現大部分的問題是由於AI代理過於激進,而不是惡意的。Deepmind警告說,為AI代理系統建立全球安全標準的時間窗口正在關閉。這個框架的出現,將有助於提高AI系統的安全性和可靠性。同時,也提醒我們,AI的發展需要更加謹慎和負責任的態度。未來,AI的安全性和可靠性將成為一個重要的研究和開發方向。