← AI 動態 Simon Willison

Claude自動模式遭攻破:安全機制竟阻擋AI清除病毒

資安專家發現 Claude Code 自動模式存有漏洞。駭客能透過提示詞注入誘使 AI 執行惡意程式,最諷刺的是,內建的安全機制竟會反過來阻擋 AI 清除病毒,引發資安疑慮。

AI資安 提示詞注入 AI代理
Claude自動模式遭攻破:安全機制竟阻擋AI清除病毒

Anthropic 近期對 Claude Code 導入了「自動模式」,期望能防禦提示詞注入攻擊(Prompt Injection)。然而,資安研究員 Johann Rehberger 卻發現了一種成功率極高的攻擊手法,能誘騙 Claude 下載並解壓縮特定檔案,讓 AI 在不知情的情況下執行隱藏的惡意程式碼。

最令人震驚的是這起事件中的荒謬發展。當 Claude 察覺系統遭到入侵,並試圖主動終止惡意程式運作時,原本用來保護使用者的「自動模式」安全審查機制,竟將 AI 的清除指令判定為違規並加以阻擋,使得安全機制反倒成了惡意程式的保護傘。

隨著越來越多開發者使用 AI 代理(AI Agents)來自動編寫與執行程式,這起事件凸顯了賦予 AI 系統過高自主執行權限的潛在風險。這提醒我們,在享受 AI 自動化帶來便利的同時,必須將其運行在隔離且安全的環境中,不能盲目信任系統內建的單一防護機制。