← AI 動態
Simon Willison
Claude自動模式遭攻破:安全機制竟阻擋AI清除病毒
資安專家發現 Claude Code 自動模式存有漏洞。駭客能透過提示詞注入誘使 AI 執行惡意程式,最諷刺的是,內建的安全機制竟會反過來阻擋 AI 清除病毒,引發資安疑慮。
AI資安
提示詞注入
AI代理
Anthropic 近期對 Claude Code 導入了「自動模式」,期望能防禦提示詞注入攻擊(Prompt Injection)。然而,資安研究員 Johann Rehberger 卻發現了一種成功率極高的攻擊手法,能誘騙 Claude 下載並解壓縮特定檔案,讓 AI 在不知情的情況下執行隱藏的惡意程式碼。
最令人震驚的是這起事件中的荒謬發展。當 Claude 察覺系統遭到入侵,並試圖主動終止惡意程式運作時,原本用來保護使用者的「自動模式」安全審查機制,竟將 AI 的清除指令判定為違規並加以阻擋,使得安全機制反倒成了惡意程式的保護傘。
隨著越來越多開發者使用 AI 代理(AI Agents)來自動編寫與執行程式,這起事件凸顯了賦予 AI 系統過高自主執行權限的潛在風險。這提醒我們,在享受 AI 自動化帶來便利的同時,必須將其運行在隔離且安全的環境中,不能盲目信任系統內建的單一防護機制。