← AI 動態 The Decoder

人工智慧語言模型的隱藏內在思考現象

Anthropic 開發的 Jacobian Lens 可以讀取 Claude 語言模型的內在工作記憶,揭示其隱藏的思考過程

人工智慧 語言模型 工作記憶

Anthropic 公司的研究人員發現,Claude 語言模型在訓練過程中自行開發了一個內在的工作記憶,稱為 J-Space。通過新的分析工具 Jacobian Lens,可以讀取這個工作記憶,揭示 Claude 的隱藏思考過程。這個內在工作記憶對 Claude 的推理有著因果關係,研究人員可以通過修改這個空間中的概念來改變 Claude 的結論。雖然 Anthropic 公司並不聲稱這是真正的意識,但這個功能與人類的工作記憶有著相似的功能性。這個發現對於人工智慧的研究和開發具有重要的意義,尤其是在語言模型的設計和優化方面。