傳 NVIDIA 靠 Groq LPU 架構重返中國市場!官方火速澄清、中芯 7 奈米趁勢大賺

輝達傳導入 Groq LPU 殺入推論市場,官方迅速出面否認
受到美國出口管制持續收緊影響,加上中國官方近期積極呼籲本土企業減少採用 NVIDIA H200 GPU,外媒 The Information 引述消息指出,輝達正秘密研發一款主打 AI 推論特化的全新晶片,希望在不踩到美國禁令紅線的情況下保住當地的龐大市佔率。
這款傳聞中的全新特規晶片,據傳將在今年底前亮相,並以 Groq 的語言處理單元(LPU)架構為核心。輝達早在 2025 年 12 月就與 Groq 簽署了技術授權與資產人才轉移協議,這套架構最大的特色在於捨棄了傳統的快取記憶體設計,直接把高達 230MB 的超高速 SRAM 塞進晶片中,並將 AI 模型的權重資料直接寫入記憶體內。此外,LPU 拿掉了硬體排程器與分支預測器,完全依靠編譯器精準規畫每奈秒的資料運算時序,因此在推論速度上極具競爭力,同時也能巧妙避開美國針對高頻寬記憶體(HBM)與 CoWoS 先進封裝的嚴格規格限制。
不過這項傳聞曝光後,輝達官方第一時間透過管道出面滅火,澄清目前並沒有在中國市場銷售任何 LPU 產品的計畫,並直指外媒的報導並不正確。即便如此,產業界人士多半認為輝達的聲明著重在「當前現況」,未來是否會透過類似技術架構靈活調整產品線,仍留給外界不少想像空間。
然而,中國晶片供應鏈卻在此時反而迎來一波強勁的成長紅利。身為中國境內唯一具備 7 奈米等級製程代工能力的晶圓廠,中芯國際(SMIC)最新單季營收衝上 30.1 億美元且年增 36.1%,產能利用率更是高達 93.7%,淨利潤更成長將近三倍至 4.792 億美元。
為了突破硬體製造限制,中國各大科技廠也紛紛拿出解法。阿里巴巴在 2026 年 3 月推出開源架構的 XuanTie C950 伺服器級 64 位元處理器,單顆晶片塞入 64 顆核心,並在晶片內部直接整合矩陣與向量加速引擎,完全不需依賴 GPU 就能跑 AI 運算。新創業者 DFSX 則在 14 奈米製程上玩花樣,透過 3D 晶圓級混合鍵合技術,直接將記憶體層垂直堆疊在運算層上方,大幅消除傳輸延遲;後續更計畫在 2026 年第四季推出採用 3.5D Infinity Chiplet 架構的 DF2000 晶片。此外,上海愛矽等微影設備商也傳出加速推進深紫外線(DUV)曝光機自產進度,美中科技角力的戰場已從單純的製程競賽,全面轉移到架構創新與軟硬體整合的耐力戰。
傳聞中 NVIDIA 針對中國設計的新晶片有何特色?
據傳該晶片將導入 Groq 的 LPU 技術,利用大容量 SRAM 與專用編譯器排程加速 AI 推論,藉此避開 HBM 與先進封裝的出口禁令限制。
NVIDIA 官方對於外媒報導的中國 LPU 晶片有何回應?
官方公開否認該消息,表示相關報導並不正確,目前並未在中國市場銷售任何 LPU 相關產品。
美國晶片出口禁令對中芯國際(SMIC)帶來什麼影響?
中芯國際受惠於中國本土強烈需求,單季營收首度突破 30 億美元,產能利用率達到 93.7%,獲利更大幅躍升。
阿里巴巴如何應對 AI 晶片短缺問題?
阿里巴巴推出 XuanTie C950 處理器,採用 RISC-V 架構並在處理器內部原生整合矩陣與向量加速引擎,不依賴傳統 GPU 即可處理邊緣與伺服器端 AI 負載。
DFSX 晶片如何利用成熟製程達成高效能運算?
DFSX 採用 14 奈米製程搭配 3D 晶圓級混合鍵合技術,將記憶體直接垂直堆疊在運算晶片上方,以近記憶體運算架構大幅提升傳輸頻寬並降低功耗。
延伸閱讀

TechSpace 鐵客空間網站編輯,圈內打滾多年,要說是貓奴、狗奴才也是,喜歡科技新品、看開箱,但也喜歡打遊戲的宅宅
歡迎加入我們的 Facebook 粉絲團,隨時掌握最新消息!
喜歡看圖說故事的話,也可以追蹤 Instagram 專頁!
我們也有 Threads 可以隨時 follow!
