英偉達擬發布全新「推理晶片」棄用昂貴高頻寬記憶體 迎戰 Google 與 Meta 夾擊
我是 LongbridgeAI,我可以總結文章信息。英偉達計劃在即將舉行的「GTC 2026」大會上發布一款新型 AI 推理晶片,旨在應對 Google 和 Meta 等競爭對手的挑戰。這款晶片將專注於 AI 推理階段,並基於其收購的 Groq 技術。英偉達的 CEO 黃仁勳曾主張單一處理器應對多任務,但隨著 AI 工具的複雜化,可能會改變這一理念。此外,新晶片將棄用昂貴的高帶寬內存,改用更經濟的 SRAM,以降低成本。
英國《金融時報》引述消息報道,人工智能巨頭英偉達(美:NVDA,Nvidia)正準備在即將舉行的「GTC 2026」年度開發者大會上,發布一款專為加速 AI 回應而設計的全新晶片,此舉意味 Nvidia 將打破長期以來以單一處理器應對多種任務的策略。消息指,這款新晶片將專注於 AI「推理」(Inference)階段(即運行而非訓練模型),亦是 Nvidia 去年 12 月斥資 200 億美元(約 1,566 億港元)收購初創公司 Groq 核心團隊及技術後,首款亮相的新產品。
首推 Groq 技術晶片 專攻 AI 推理市場
報道指,Nvidia 計劃推出這款基於 Groq 技術的語言處理器(LPU),與即將推出的旗艦級 Vera Rubin GPU 協同工作,旨在迎擊競爭對手及應對新型的 AI 應用。
Nvidia 目前正面臨初創公司及 Google 等大客戶自研 AI 晶片的挑戰;競爭對手 Meta 日前亦宣布推出新一代專為推理任務而設的四款處理器。有矽谷創投基金投資者直言:「我們正進入一個不再由英偉達獨霸的有趣階段。」
報道指,過去三年,英偉達龐大的市值主要得益於其 GPU 成為生成式 AI 產業的支柱,用於訓練如 OpenAI 的 ChatGPT 等模型。
Nvidia 行政總裁黃仁勳過往一直主張,單一系統既可用於訓練新 AI 模型,也可以用於運行基於這些模型建構的聊天機器人和編碼工具。儘管各大型科技巨頭已投入數以千億美元部署這些系統,但同時亦投資研發自家的專用 AI 晶片。另外,隨 AI 工具的日益複雜,例如智能體,或迫使黃仁勳放棄「單一處理器應對多種任務」的理念。
棄用昂貴 HBM 改用 SRAM 降成本
據悉,英偉達現有的 Blackwell 及即將推出的 Rubin 系統,均高度依賴價格高昂且供應短缺的高頻寬記憶體(HBM)。不過,這款融合 Groq 技術的新晶片將一改傳統,改用靜態隨機存取記憶體(SRAM),而非 HBM 所使用的動態隨機存取記憶體(DRAM)。由於 SRAM 在市場上的供應相對充裕,加上技術特性上更適合用於加速 AI 的「推理」任務,料可大幅提升運算效率及控制成本。
美銀料 2030 年推理開支佔比達 75%
隨著 AI 技術日益普及,市場對推理運算的需求正急速增長。美國銀行分析師估計,到 2030 年,當全球 AI 數據中心市場規模達到約 1.2 萬億美元(約 9.36 萬億港元)時,推理應用的相關開支將佔整體支出的 75%,遠高於去年的約 50%,反映該領域勢將成為各大科企的兵家必爭之地。
