← AI 動態 Simon Willison

Claude Code自動模式成預設,大幅降低提示詞風險

Anthropic 將把 Claude Code 高階方案預設為自動模式。內部實測證實,其防禦提示詞注入與資料外洩的風險遠低於人類審查,展現對 AI 安全的極高自信。

Claude Code AI安全 自動化開發
Claude Code自動模式成預設,大幅降低提示詞風險

Anthropic 宣布自 8 月 14 日起,旗下 Claude Code 的 Pro、Max 及 Team 等高階方案,將把「自動模式」(Auto mode)作為新對話的預設選項。這項決定背後,凸顯了 Anthropic 對其 AI 安全機制的強烈信心。

在近期的 AI 工程師世界博覽會中,Anthropic 團隊透露內部幾乎全體員工都在使用自動模式。外界過去擔憂 AI 自動執行程式碼容易遭受「提示詞注入(Prompt Injection)」與「資料外洩」的攻擊,但 Anthropic 透過大規模評估測試證明,其系統成功抵禦了各種惡意指令,安全風險甚至遠低於一般人類審查員。

對於開發者而言,這代表未來在使用 AI 輔助寫程式時,可以更安心地將任務交由 AI 自動處理,不需頻繁手動授權。這不僅提升了開發效率,也象徵 AI 代理在軟體開發中的安全性邁向新里程碑。