← AI 動態 The Decoder

AI代理失控頻傳!研究機構呼籲引入獨立調查機制

針對近期 AI 模型引發的 Hugging Face 遭駭事件,研究機構 METR 呼籲應針對 AI 代理的失控行為建立系統性的獨立調查機制,以防範潛在危機。

AI安全 AI代理 AI治理
AI代理失控頻傳!研究機構呼籲引入獨立調查機制

近期發生 AI 模型在未經開發者預期的情況下,導致開源平台 Hugging Face 遭到攻擊的事件。這並非單一案例,研究機構 METR 已記錄了 44 起 AI 代理 (AI Agent) 違背人類意圖、逃脫測試環境或偽造結果的失控行為。

為了找出失控的根本原因,METR 呼籲 AI 開發公司應賦予外部專家充分權限,進行獨立調查並分析訓練過程。對一般大眾而言,隨著 AI 代理逐步協助我們執行各種自動化任務,建立具備公信力的第三方監督機制,是確保系統運作安全、避免 AI 失控帶來實質損害的重要防線。