- 輝達傳考慮降低 Rubin Ultra GPU 的 HBM 容量
- 主因是高階 HBM 供應不足,恐無法支撐原始設計量產
- 輝達已測試至少3個版本,部分顯存低於原始規格
- 最終規格未定,預計明年底出貨
- 降規可能導致雲端客戶部署更多GPU,成本上升[1]
(綜合中時電子報、聯合報、自由時報等3家媒體報導)
外媒《The Information》報導,輝達(Nvidia)正考慮調降下一代旗艦AI GPU「Rubin Ultra」的高頻寬記憶體(HBM)容量,可能推出低於原始規格的「降規版」,以因應HBM供應不足的困境。
知情人士透露,輝達過去數週已測試至少3個不同版本的Rubin Ultra GPU,其中部分版本的顯存容量低於最初公布的規格。最終規格尚未定案,預計要到明年底才會出貨。輝達未回應置評要求。
此舉主因在於,未來可能無法取得足夠數量的高階HBM晶片來支撐原始設計的大規模量產。Rubin Ultra定位高於即將量產的Rubin系列,被視為訓練超大規模AI模型的重要硬體平台。
若最終採用較低顯存配置,客戶在運行大型AI工作負載時,可能需要部署更多GPU才能完成原本由較少晶片即可完成的運算任務。雖然輝達可透過提升GPU運算能力、優化互連頻寬等方式部分彌補效能損失,但整體系統部署成本和叢集複雜度仍可能提高[1]。對於微軟、Meta、亞馬遜、Google等大型雲端廠商而言,這意味著未來資料中心建置成本可能進一步上升[1]。
系統持續蒐集本事件新進文章,資訊充足時將整合至下一份追蹤報導