Samsung Foundry 為 Nvidia 代工生產 Groq 3 LPX 晶片的計劃已進入全面量產階段,為 Samsung 帶來顯著的業績與市場信心提振。Nvidia 採用 Samsung 4nm 製程生產的 Groq 3 LPX 晶片,隸屬於語言處理單元(LPU)架構,專門用於 AI 推論工作負載,與負責平行運算與模型訓練的傳統 GPU 形成互補。
隨著 AI 模型由訓練階段進入回應生成階段,傳統 GPU 在記憶體存取與快取延滯方面容易出現瓶頸。LPU 架構正是針對此類瓶頸而設計,旨在加速低延遲的 token 生成。Groq 由前 Google 工程師於 2016 年創立,主導者 Jonathan Ross 同時也是 Google 知名張量處理單元(TPU)的發明人之一。Nvidia 於 2025 年 12 月斥資 US$200 億 (約 HK$1,560 億) 向 Groq 取得非獨家知識產權授權,並吸納大部分核心工程人才。
Groq 3 LPX 平台速度為同類方案四倍
Nvidia 將採用 Samsung 4nm 製程的 Groq LP30 晶片整合至最新的 Vera Rubin 平台,現已進入全規模量產。該晶片負責驅動 AI 代理(agent)系統,並提升回應速度。每組機櫃規模(rack-scale)的 Vera Rubin 配置採用 256 顆 LPU,晶片於 Samsung 位於韓國平澤的廠區製造。
根據 Artificial Analysis 近期基準測試,採用開源 Gemma 4 31B 模型與 10 萬 token 上下文長度的條件下,Groq 3 LPX 平台達到 3,400 輸出 token/秒,速度為同類方案的 4 倍,特別適用於長上下文代理工作負載。AI 雲端服務商 Nebius 已成為首批採用 Groq 3 LPX 平台的客戶,藉此提升 token 生成速度。
另一方面,CoreWeave 已將 Spectrum-X Multiplane 技術投入生產環境,用於連接 Vera Rubin 機櫃;Elon Musk 旗下的 SpaceXAI 亦將大規模採用 Nvidia Vera CPU,部署於其數據中心及衞星系統內的代理 AI 架構。
Samsung Foundry 客戶羣擴張 有望於 2027 年恢復全年盈利
過去一年,曾錄得巨額虧損的 Samsung Foundry 先後迎來多個新客戶。當中最具標誌性的交易,是 Samsung 以 2nm 製程為 Tesla 生產 AI6 晶片的 US$165 億 (約 HK$1,287 億) 合約,其後亦接下 Tesla AI5 晶片的追加生產訂單。市場亦傳出 Samsung 正與 Anthropic、比亞迪(BYD)、字節跳動(TikTok)、Meta 及 Neuralink 等公司洽談 AI 晶片代工事宜。
業界報告指出,Samsung Foundry 有望於 2027 年重新錄得全年盈利。這家韓國晶圓代工廠商似乎已收復失地,為日後挑戰主要競爭對手台積電(TSMC)奠定基礎。
項目 規格 晶片名稱 Groq 3 LPX 製程節點 Samsung 4nm 架構類型 語言處理單元(LPU) 主要用途 AI 推論、加速 token 生成 每機櫃 LPU 數量 256 顆 生產地點 Samsung 平澤廠區(韓國) 整合平台 Nvidia Vera Rubin 測試模型 Gemma 4 31B(10 萬 token 上下文) 基準輸出速度 3,400 token/秒
利益聲明:本文包含合作商戶產品連結,如你透過連結購買,TechRitual 可能獲得佣金收入,但不影響產品評價及推薦。詳情請參閱私隱政策。

