SpaceX攜輝達,馬斯克:太空AI資料中心明年升空
SpaceX與輝達(NVIDIA)合作打造的首批AI衛星Starmind AI1,將於明年第4季發射、2028年大規模部署,較原計畫提前至少一年;SpaceX同步向美國聯邦通訊委員會申請部署最多100萬顆衛星的網絡,並規劃明年底AI算力達近10 GW。
GPU運算單元的算力遠快過記憶體搬資料的速度,頻寬而非算力才是AI推理實際的限制CITE:E1。大型語言模型推理時,權重必須反覆從記憶體讀進運算單元CITE:E1,這種資料搬運速度跟不上運算速度的落差,即是產業所稱的「記憶體牆」CITE:E1。
HBM以垂直堆疊DRAM晶粒與矽中介層寬匯流排的3D封裝架構,突破頻寬限制CITE:E2。高頻寬記憶體(High Bandwidth Memory,HBM)用極寬的資料通道換取遠高於傳統DDR/GDDR記憶體的頻寬,並直接貼近GPU以縮短資料搬運距離CITE:E2。
HBM單堆疊頻寬十年間從256 GB/s成長到2 TB/s,提升近8倍CITE:E3。
| 世代 | 標準/量產年 | 單堆疊頻寬 |
|---|---|---|
| HBM2 | 2016 | 256 GB/s |
| HBM2E | — | 307 GB/s |
| HBM3 | 2022 | 819 GB/s |
| HBM3E | 2024量產 | 約1.2 TB/s |
| HBM4 | 2025標準 | 2 TB/s |
(資料來源:CITE:E3)
相較之下,傳統伺服器用的DDR5 DIMM頻寬約每通道數十GB/s,消費級GPU用的GDDR6/7約數百GB/sCITE:E7;而單顆AI加速器可搭載多個HBM堆疊,總頻寬可達數TB/s等級,這是HBM專為AI與高效能運算而生的關鍵差異CITE:E7。
HBM最大堆疊層數與單堆疊容量同步提升,HBM3已達16-Hi、單堆疊64GBCITE:E4。HBM2為8-Hi、單堆疊8GB,到HBM3提升至16-Hi、64GB,HBM4同樣維持16-Hi、64GB的規格CITE:E4,讓單顆AI加速器能就近容納更大的模型權重CITE:E4。
| 世代 | 最大堆疊層數 | 單堆疊容量 |
|---|---|---|
| HBM2 | 8-Hi | 8GB |
| HBM3 | 16-Hi | 64GB |
| HBM4 | 16-Hi | 64GB |
(資料來源:CITE:E4)
2026年第1季HBM市場由SK海力士以58%市佔居首,三星與美光各約21%並列第二CITE:E5。
| 廠商 | 2026年Q1市佔 | 去年同期市佔 |
|---|---|---|
| SK海力士 | 58% | 69% |
| 三星 | 約21% | — |
| 美光 | 約21% | — |
(資料來源:CITE:E5)
SK海力士的市佔較去年同期69%下滑CITE:E5,三家廠商的HBM4皆已獲輝達(NVIDIA)認證CITE:E5。HBM之所以昂貴且供給吃緊,源於其製程難度:垂直堆疊需以TSV(矽穿孔)技術逐層打通,良率與封裝複雜度遠高於平面DRAM,產能擴充速度跟不上AI需求的成長CITE:E6。
HBM頻寬十年間從256 GB/s成長到2 TB/s、容量也同步從8GB擴大到64GB,直接對應了記憶體牆問題CITE:E3CITE:E4;但這個解方本身仍受限於TSV製程的良率與封裝複雜度CITE:E6,而供應端集中在SK海力士、三星、美光三家,且SK海力士市佔已從69%降至58%CITE:E5,顯示頻寬與容量的技術突破,並未同步解決供應面的結構性瓶頸。
GPU運算單元的算力遠快過記憶體搬資料的速度,頻寬而非算力才是AI推理實際的限制CITE:E1。大型語言模型推理時,權重必須反覆從記憶體讀進運算單元CITE:E1,這種資料搬運速度跟不上運算速度的落差,即是產業所稱的「記憶體牆」CITE:E1。
HBM以垂直堆疊DRAM晶粒與矽中介層寬匯流排的3D封裝架構,突破頻寬限制CITE:E2。高頻寬記憶體(High Bandwidth Memory,HBM)用極寬的資料通道換取遠高於傳統DDR/GDDR記憶體的頻寬,並直接貼近GPU以縮短資料搬運距離CITE:E2。
HBM單堆疊頻寬十年間從256 GB/s成長到2 TB/s,提升近8倍CITE:E3。
HBM最大堆疊層數與單堆疊容量同步提升,HBM3已達16-Hi、單堆疊64GBCITE:E4。HBM2為8-Hi、單堆疊8GB,到HBM3提升至16-Hi、64GB,HBM4同樣維持16-Hi、64GB的規格CITE:E4,讓單顆AI加速器能就近容納更大的模型權重CITE:E4。
SK海力士的市佔從69%降至58%,顯示其原本接近壟斷的地位正在鬆動,三星與美光各站穩21%且HBM4皆已通過輝達認證,代表供應版圖可能持續分散。由於HBM製程仍受TSV良率與封裝複雜度限制,產能能否跟上需求,將決定這場市佔重分配是暫時性波動還是結構性轉變。接下來要看的是下一季三家廠商的市佔數字,特別是HBM4放量後SK海力士能否止跌。
SpaceX與輝達(NVIDIA)合作打造的首批AI衛星Starmind AI1,將於明年第4季發射、2028年大規模部署,較原計畫提前至少一年;SpaceX同步向美國聯邦通訊委員會申請部署最多100萬顆衛星的網絡,並規劃明年底AI算力達近10 GW。
輝達(NVIDIA)於2026年8月25日發表新款機器人電腦Jetson Orin Nano 2,主打入門級邊緣AI,提供78 TOPS運算效能、8GB記憶體與8核心Arm CPU,推論效能達前代2倍、相同效能下功耗降低40%。
輝達宣布Groq 3 LPX機櫃全面量產,搭載256顆Groq 3 LPU晶片,Nebius成為首家採用的雲端服務商,機櫃將於今年稍晚部署Vera CPU與Rubin GPU,作為Vera Rubin平台的低延遲推論拼圖。