最近的一項研究表明,AI 編碼代理雖然能夠找到正確的檔案,但往往錯過檔案中的關鍵行。這項研究使用了一個新的基準測試,稱為 SWE-Explore,來評估 AI 編碼代理的性能。結果顯示,AI 編碼代理可以找到正確的檔案,但在找到關鍵行方面表現不佳。这項研究對於理解 AI 編碼代理的局限性和改進其性能具有重要意義。研究人員認為,AI 編碼代理需要更多的上下文信息來找到正確的關鍵行。這項研究的結果對於開發更好的 AI 編碼代理具有重要的參考價值。
最近的一項研究表明,AI 編碼代理雖然能夠找到正確的檔案,但往往錯過檔案中的關鍵行。這項研究使用了一個新的基準測試,稱為 SWE-Explore,來評估 AI 編碼代理的性能。結果顯示,AI 編碼代理可以找到正確的檔案,但在找到關鍵行方面表現不佳。这項研究對於理解 AI 編碼代理的局限性和改進其性能具有重要意義。研究人員認為,AI 編碼代理需要更多的上下文信息來找到正確的關鍵行。這項研究的結果對於開發更好的 AI 編碼代理具有重要的參考價值。