半導體專題

PCIe 演進全解析:從 32 GT/s 到 7.0 的 512 GB/s,如何撐起 AI 加速器叢集

N
Nathan科技編輯 · 技術負責人
發布 · 更新
PCIe 是連接處理器與顯示卡、SSD、網卡等裝置的序列擴充匯流排標準,通道數決定頻寬疊加。PCIe 7.0 傳輸率達 128 GT/s,x16 連結最高 512 GB/s,可連接多組加速器處理 AI 模型;NVIDIA Grace 目前部署的 PCIe Gen 5 x16 則為 128 GB/s。

PCIe 是什麼?定義、角色與業界應用

Intel 將 PCI Express(PCIe)定義為一種標準化的點對點序列互連介面。CITE:E1 這項介面廣泛應用於運算與嵌入式裝置產業,作為處理器對接顯示卡、SSD、網卡等各式裝置的擴充通道。CITE:E1

PCIe 連結配置如何決定頻寬疊加?

Intel 指出 PCIe 連結以 x1、x2、x4、x8、x16 等通道數表示。CITE:E2 通道數愈多,可疊加的頻寬愈高,這是 PCIe 架構擴充頻寬的基本機制。CITE:E2

PCIe 6.0 與 7.0 的速率提升與最高頻寬達成

Synopsys 指出 PCIe 6.0 將每通道傳輸率由 32 GT/s 翻倍至 64 GT/s。CITE:E3 PCIe 7.0 進一步將傳輸率推升至 128 GT/s,經 x16 連結可達最高 512 GB/s 雙向頻寬。CITE:E4

項目數值
PCIe 5.0 → 6.0 每通道傳輸率提升32 GT/s → 64 GT/s
PCIe 7.0 每通道傳輸率128 GT/s
PCIe 7.0 x16 最高雙向頻寬512 GB/s
NVIDIA Grace 每組 PCIe Gen 5 x16 頻寬128 GB/s
NVIDIA Grace PCIe Gen 5 x16 連結組數8 組

PCIe 7.0 的高頻寬如何支撐 AI 與機器學習工作負載?

Synopsys 表示 PCIe 7.0 最高 512 GB/s 的頻寬可連接多個加速器。CITE:E5 其 load-store 能力與安全資料傳輸機制,使系統得以有效率地處理大型且複雜的 AI 與機器學習模型。CITE:E5

實際應用:數據中心架構中的 PCIe(以 NVIDIA Grace 為例)

NVIDIA 在 Grace CPU Superchip 中部署 8 組 PCIe Gen 5 x16 連結。CITE:E6 每組連結可支援最高 128 GB/s 雙向頻寬,用於連接 GPU、網卡與儲存等資料中心裝置。CITE:E6

綜合前文數字,PCIe 傳輸率已由 32 GT/s、64 GT/s 推進至 128 GT/s,x16 連結最高雙向頻寬達 512 GB/s。CITE:E3CITE:E4 相較之下,NVIDIA Grace CPU Superchip 目前部署的 PCIe Gen 5 x16 連結,每組僅支援 128 GB/s。CITE:E6 512 GB/s 與 128 GB/s 之間的四倍差距,顯示 PCIe 規格演進速度領先於目前資料中心的實際部署世代;而 Synopsys 所述 PCIe 7.0 連接多加速器、處理大型 AI 模型的能力,正對應這個尚未被目前部署填滿的頻寬空間。CITE:E5

📊 證據與數據

常見問題

PCIe 是什麼?定義、角色與業界應用

Intel 將 PCI Express(PCIe)定義為一種標準化的點對點序列互連介面。CITE:E1 這項介面廣泛應用於運算與嵌入式裝置產業,作為處理器對接顯示卡、SSD、網卡等各式裝置的擴充通道。CITE:E1

PCIe 連結配置如何決定頻寬疊加?

Intel 指出 PCIe 連結以 x1、x2、x4、x8、x16 等通道數表示。CITE:E2 通道數愈多,可疊加的頻寬愈高,這是 PCIe 架構擴充頻寬的基本機制。CITE:E2

PCIe 7.0 的高頻寬如何支撐 AI 與機器學習工作負載?

Synopsys 表示 PCIe 7.0 最高 512 GB/s 的頻寬可連接多個加速器。CITE:E5 其 load-store 能力與安全資料傳輸機制,使系統得以有效率地處理大型且複雜的 AI 與機器學習模型。CITE:E5

📎 資料來源

  1. intel.com
  2. synopsys.com
  3. synopsys.com
  4. developer.nvidia.com

延伸數據

作者觀點Nathan

PCIe 傳輸率從 32 GT/s 一路翻倍到 128 GT/s,但目前資料中心主力部署如 NVIDIA Grace 仍停留在 PCIe Gen 5、每組 x16 僅 128 GB/s,與 7.0 規格的 512 GB/s 存在四倍落差。這個落差說明規格先行、實際部署滯後是介面世代交替的常態,而非執行面出現問題。值得追蹤的觀察指標是:後續資料中心加速器叢集是否開始採用 PCIe 7.0 x16 連結,這將決定 512 GB/s 頻寬何時從規格書轉化為 Synopsys 所稱的多加速器、大型 AI 模型實際處理能力。

N
Nathan科技編輯 · 技術負責人

相關文章

快訊

Google宣布在芬蘭投資130億歐元建置AI基礎設施

Google宣布2027至2028年將在芬蘭投資130億歐元(151億美元)建置AI基礎設施,為其歐洲最大單一投資案,涵蓋三處新建與一處擴建資料中心,並與Fortum簽署22年購電協議取得核電機組50%發電量。

EffectStory 編輯部 ·