頂尖數學家 Timothy Gowers 和 Peter Sarnak 評價 LLM 擁有強大的計算能力,但在真正新穎的數學想法方面存在局限性。Gowers 指出,當前模型擅長結合既有方法和嘗試多個搜索路徑,但缺乏直覺來選擇少數生產性的路徑。Sarnak 表示,AI 可以從既有理論中推導結果,但在從基本問題出發時,無法開發出支撐重大證明的抽象概念。這些評價與 DeepMind 研究人員 Tom Zahavy 的觀點相似,後者認為 LLM 的瓶頸在於缺乏「操作性歸納」能力。這些評價對於我們理解 LLM 的能力和局限性具有重要意義,同時也對未來 AI 研究的方向提供了思考。