Google 要將 Gemini 架構刻入晶片,推理能效最高提升 10 倍

robot
摘要生成中
ME AI 訊息,根據偵察 Beating 監測,據傳 Google 正在研發 Frozen v2 AI 推理晶片。它將把 Gemini 的部分架構直接固化進晶片,降低執行模型時的計算與資料搬運。內部預估,它每瓦可處理的 Token 數將達到最新 TPU 的 6 至 10 倍。Google 計畫最早於 2028 年部署。Google 希望用它來緩解算力短缺。缺口已迫使 Google Cloud 拒絕部分外部客戶訂單。Frozen v2 將與 TPU 並行存在。TPU 可以運行不同模型,而 Frozen v2 則以靈活性換取效率。這也是一場架構押注。未來若 Gemini 大幅改動底層設計,這批晶片可能將無法繼續使用。(來源:BlockBeats)
查看原文
此頁面可能包含第三方內容,僅供參考(非陳述或保證),不應被視為 Gate 認可其觀點表述,也不得被視為財務或專業建議。詳見聲明
  • 打賞
  • 回覆
  • 轉發
  • 分享
回覆
請輸入回覆內容
請輸入回覆內容
暫無回覆
  • 已置頂