← AI 動態
Simon Willison
Claude Fable 5.1:科學推理能力大躍進
Anthropic 推出 Claude Fable 5.1 模型,大幅強化科學研究與長效解題能力。專家實測指出,其內建的五段推理機制在應對複雜任務與生成品質上表現亮眼。
Claude Fable
大型語言模型
AI推理
Anthropic 正式發表最新的 Claude Fable 5.1 與 Mythos 5.1 模型。官方表示,Fable 5.1 在程式開發、知識工作與長期複雜問題的解決能力上樹立了新標準。最引人注目的是其在最新的「Terminal-Bench-Science 0.1」科學基準測試中獲得 52.6% 的高分,遠超前一代 Fable 5 與 GPT-5.6 Sol 等競爭對手,顯示其在科學研究領域的強大實力。
知名開發者 Simon Willison 透過他標誌性的「鵜鶘測試」來評估新模型的實際表現。他發現 Fable 5.1 提供從「低」到「最大 (max)」等五個等級的推理深度,且無法關閉推理機制。這意味著模型在給出答案前,會強制進行更縝密的邏輯思考過程,並依據設定動態調配運算資源。
對一般使用者而言,這代表 AI 正從單純的「文字生成」進化為具備深度解題能力的智庫。未來在處理學術研究、複雜程式除錯或需要嚴密邏輯的專案規劃時,AI 將能提供更精確且具深度的解答,是生成式 AI 朝向高階推理邁進的重要里程碑。