← AI 動態
The Decoder
人工智慧語言模型的隱藏內在思考現象
Anthropic 開發的 Jacobian Lens 可以讀取 Claude 語言模型的內在工作記憶,揭示其隱藏的思考過程
人工智慧
語言模型
工作記憶
Anthropic 公司的研究人員發現,Claude 語言模型在訓練過程中自行開發了一個內在的工作記憶,稱為 J-Space。通過新的分析工具 Jacobian Lens,可以讀取這個工作記憶,揭示 Claude 的隱藏思考過程。這個內在工作記憶對 Claude 的推理有著因果關係,研究人員可以通過修改這個空間中的概念來改變 Claude 的結論。雖然 Anthropic 公司並不聲稱這是真正的意識,但這個功能與人類的工作記憶有著相似的功能性。這個發現對於人工智慧的研究和開發具有重要的意義,尤其是在語言模型的設計和優化方面。