← AI 動態
The Decoder
AI 編寫瀏覽器攻擊程式:Claude Mythos 和 GPT-5.5 的實力對比
研究人員開發新benchmark評估AI編寫瀏覽器攻擊程式的能力,Claude Mythos 和 GPT-5.5 的結果出爐
AI 安全
瀏覽器攻擊
Claude Mythos
GPT-5.5
近日,卡內基梅隆大學的研究人員開發了一個新的benchmark,評估AI編寫瀏覽器攻擊程式的能力,特別是針對Google的V8 JavaScript引擎。結果顯示,Anthropic的Claude Mythos Preview模型表現出色,超越了OpenAI的GPT-5.5,甚至達到了與人類安全研究人員相當的水平。然而,Mythos的成本相對較高,每次測試的成本約為36,400美元,遠遠高於GPT-5.5的成本。這個benchmark的結果對於AI安全研究具有重要意義,揭示了AI編寫瀏覽器攻擊程式的能力和局限性。這項技術的進步對於網路安全產生了深遠的影響,同時也引發了對AI安全的關注和討論。