Samsung 宣佈全球首次開發出針對移動端等端側 AI 裝置的下一代記憶體 LPDDR-PIM,將運算功能整合至移動記憶體之中,聲稱能夠有效提升 AI 處理速度並同時降低功耗。Samsung 相關負責人近日於美國史丹福大學舉行的半導體學術會議 Hot Chips 2026 上,公開 LPDDR5X-PIM 的結構、規格及驗證結果。該產品本月初在 FMS 2026 記憶體會議上取得下一代記憶體獎項,今次則是首次對外披露詳細規格。
PIM 技術透過在記憶體內嵌入運算單元,使部分運算能夠直接在記憶體內部完成。在傳統架構下,記憶體所儲存的數據須先傳送至中央處理器或圖形處理器進行運算,再將結果傳回記憶體。採用 PIM 之後,相對簡單的運算可在記憶體內部處理,減少 AI 運作中主要樽頸之一的數據搬運,兼顧速度與功耗表現。
LPDDR5X-PIM 處理速度較普通版本快 2.3 倍
Samsung 以參數規模達 80 億的 Meta 開源 AI 模型 Llama 3.1 為測試對象,結果顯示 LPDDR5X-PIM 的處理時間為 5.4 秒,較普通 LPDDR5X 的 12.3 秒快約 2.3 倍。每秒令牌處理量達到 81.3 TPS,為現有產品 27 TPS 的 3 倍。這組數據顯示,記憶體內運算技術在實際 AI 推論場景中具備明顯的效能優勢。
事實上,Samsung 早於 2021 年已公開將 PIM 應用於高頻寬記憶體的 HBM-PIM 技術,並完成開發驗證。今次則選擇將 PIM 應用於智能手機等移動裝置廣泛使用的低功耗 LPDDR 記憶體。公司方面判斷,隨着 AI 模型日益小型化及高效化,並非所有 AI 裝置都需要 HBM。
端側 AI 趨勢擴大帶動 LPDDR-PIM 應用前景
相關負責人表示,AI 支援的標準化記憶體方案雖然以 HBM 為主,但隨着近期大型語言模型朝向小型化、高效化發展,HBM 未必始終是最佳選擇,因此開發兼具高頻寬與低功耗的 LP-PIM。隨着生成式 AI 直接在智能手機或個人電腦等裝置上運行的端側 AI 趨勢擴大,LPDDR-PIM 的應用前景亦同步增長,原因是電力及空間受限的移動裝置既要提升 AI 運算效能,同時需要降低功耗。
在兼容性方面,該產品採用與通用 LPDDR 相同的陣列設計,無需大幅改動系統即可使用。Samsung 目前正提供軟件開發工具包及模擬器等資源,推動相關生態建設。繼 LPDDR5X-PIM 之後,Samsung 已啟動 LPDDR6-PIM 的標準化工作。以 HBM 為中心的 AI 記憶體競爭正向智能手機及 PC 等端側領域擴展,記憶體正由數據儲存裝置朝向直接參與運算的方向演進。
項目 規格 產品名稱 LPDDR5X-PIM 技術類型 LPDDR 記憶體內運算(PIM) Llama 3.1 處理時間 5.4 秒 普通 LPDDR5X 處理時間 12.3 秒 速度提升 約 2.3 倍 LPDDR5X-PIM 吞吐量 81.3 TPS 普通 LPDDR5X 吞吐量 27 TPS 測試模型 Meta Llama 3.1(80 億參數) 下一階段 LPDDR6-PIM 標準化
利益聲明:本文包含合作商戶產品連結,如你透過連結購買,TechRitual 可能獲得佣金收入,但不影響產品評價及推薦。詳情請參閱私隱政策。

