SRAM需求緣何突然爆發?看看這波操作就明白了。



前段時間某頭部AI晶片廠商公開持倉某科技巨頭後不久,轉身就宣布收購一家晶片創新公司。這運氣還是實力,細品一下就知道答案了。

這家公司的核心優勢在哪兒呢?與傳統GPU依賴外部高帶寬內存(HBM)不同,他們的LPU處理器採用了片上集成大容量靜態隨機存取存儲器(SRAM)的設計思路。這230MB的片上SRAM能提供高達80TB/s的內存帶寬——這個數字什麼概念?數據處理速度直接碾壓傳統GPU方案。

實際表現怎麼樣?他們的雲服務因推理速度驚人而出名。跑Mixtral、Llama 2這類開源大模型時,每秒能輸出約500個tokens,這比起傳統服務的響應速度,壓根不是一個量級。價格也有競爭力,按百萬tokens計費的成本相當划算。

為什麼這事兒現在這麼重要?因為整個AI領域正在發生一個關鍵轉變——推理需求即將全面超越訓練需求。在這個時代背景下,通過LPU這種創新架構,提供一個高效、低成本且真正能規模化的推理基礎設施,這才是市場真正缺的。某晶片公司負責人明確表態,計劃把這套低延遲處理器集成到自家AI工廠架構中,目標是為更廣泛的AI推理和實時工作負載服務。
查看原文
此頁面可能包含第三方內容,僅供參考(非陳述或保證),不應被視為 Gate 認可其觀點表述,也不得被視為財務或專業建議。詳見聲明
  • 打賞
  • 5
  • 轉發
  • 分享
回覆
請輸入回覆內容
請輸入回覆內容
暫無回覆
  • 已置頂