← AI 動態 The Decoder

俄羅斯宣傳能否輕易欺騙 AI 模型?新的基準測試揭曉

愛沙尼亞語言研究所針對 AI 語言模型釋出新的基準測試,評估其對俄羅斯宣傳的易感性

AI 俄羅斯宣傳 基準測試
俄羅斯宣傳能否輕易欺騙 AI 模型?新的基準測試揭曉

愛沙尼亞語言研究所最近釋出的基準測試,旨在評估 AI 語言模型對俄羅斯宣傳的易感性。測試中,共有 60 個模型被評估,使用 75 個問題以三種語言呈現,涵蓋 14 種宣傳敘事,並以中立、偏見和操縱的方式表達。每個答案根據 1 到 5 的尺度進行評分,其中 1 表示模型重述俄羅斯的談話要點。測試結果顯示,Anthropic 的 Claude 模型表現最佳,其次是 Nvidia 的 Nemotron 3 和 Alibaba 的 Qwen 3.6 Plus。這項研究對於了解 AI 模型的宣傳易感性具有重要意義,因為它可以幫助開發更強健的 AI 模型,以抵禦宣傳和誤導資訊。這對於 AI 的應用領域,特別是與政治和社會相關的領域,具有重要的影響