← AI 動態
The Decoder
Nvidia 新 AI 晶片號稱快四倍,專家點出算力盲點
Nvidia 宣布新 AI 推理晶片 Groq 3 LPX 量產,宣稱速度比對手快四倍。但專家指出這是用 64 顆對決 2 顆晶片的不公平比較,凸顯評估算力的盲點。
Nvidia
AI晶片
算力評估
Nvidia 近期宣布旗下專為 AI 代理設計的全新推理加速器「Groq 3 LPX」投入量產。在官方的效能測試中,該系統運行 Gemma 4 31B 模型時,達到了每秒生成 3,400 個 token 的驚人速度,Nvidia 宣稱這比競爭對手 Cerebras 快上四倍。
不過,這份亮眼的成績單背後卻藏有陷阱。業界專家指出,Nvidia 的架構需要同時串聯至少 64 顆加速器才能達到這樣的數據;反觀 Cerebras 只需要一到兩顆晶片就能達成其測試結果。這場「硬體大戰」的比較基準並不對等,引發了業界對於如何客觀評估 AI 硬體算力的討論。
對於一般企業與開發者而言,這則新聞凸顯了重要的觀念:在評估 AI 落地部署時,不能只看廠商宣傳的「最高速度」,還必須考量背後所需的硬體數量、耗電量與整體建置成本(TCO)。這將是未來企業導入 AI 基礎設施時的核心課題。