← AI 動態 Simon Willison

阿里 Qwen 3.8 27B:效能強悍但預設「想太多」

阿里最新開源的 Qwen 3.8 27B 視覺大模型,能在高階筆電順暢執行且效能驚豔。但專家發現其預設的高推論設定容易導致模型「過度思考」。

Qwen 大型語言模型 多模態AI
阿里 Qwen 3.8 27B:效能強悍但預設「想太多」

阿里巴巴 Qwen 團隊最新發布的 Qwen 3.8 27B 是一款具備視覺能力的大型語言模型,採用 Apache 2 開源授權。270 億參數的規模非常適合開發者在規格不錯的筆電上(例如新款的 MacBook)直接進行本地部署,大幅降低了 AI 應用的硬體門檻與隱私外洩風險。

根據官方數據,它的評測表現甚至超越了幾個月前強大的閉源版本 Qwen 3.7-Plus。然而,知名技術專家 Simon Willison 在實際測試後指出一個有趣的現象:這款模型官方支援「推論深度 (reasoning_effort)」的控制功能,但預設值被設定為極高(xhigh)。這雖然讓模型展現了深度的邏輯思考能力,卻也導致它在面對簡單問題時容易鑽牛角尖,產生不必要的「過度思考」並消耗額外運算資源。

對一般開發者和企業而言,這凸顯了新一代推論型 AI 的重要課題:未來在串接這類具備深度思考能力的模型時,必須更仔細地根據任務難易度來動態調整推論參數,才能在回答品質與運算成本之間取得最佳的平衡點。