英特爾(Intel)公布美國先進封裝進展:Rio Rancho廠40年蛻變,Reticle Limit達業界標準8倍
根據 Intel 官方新聞稿,新墨西哥州 Rio Rancho 先進封裝廠已將 Reticle limit 擴大至業界標準 8 倍,預計 2028 年前達 12 倍以上;該廠員工數自 1980 年的 25 人成長至 2,700 人,並擁有 500 家供應商。
根據NVIDIA部落格報導,SIGGRAPH 2026大會於美國洛杉磯舉行,展期至7月23日(週四)為止。NVIDIA的主題演講則於7月20日下午3:45(太平洋時間)登場,由NVIDIA AI研究與工程主管Neil Ashton、Edward Liu與Ming-Yu Liu共同主講,內容聚焦神經渲染技術、世界模型與「由AI打造、給AI使用」的模擬方法。
在演講開場影片中,NVIDIA創辦人暨執行長黃仁勳(Jensen Huang)表示:「創作者與設計師需要強大到足以延伸想像力、靈活到能自由塑形創意,同時精準到可如實呈現構想的工具。」這段談話為當天發表的多項技術定調。
NVIDIA表示,Cosmos系列最新成員Cosmos 3 Edge已於演講當日發布,為40億參數(4-billion-parameter)模型,設計用於裝置端即時運行。Ming-Yu Liu同時發表Cosmos-Dreams,這是一套閉環模擬器集合,其中一款針對自動駕駛打造的模擬器可從單一畫面生成整個世界,且僅需一張NVIDIA RTX PRO 6000 GPU即可運行。
NVIDIA指出,Cosmos 3 Edge在VANTAGE-Bench視覺分析評測中,於其所屬參數規模類別排名第一,並可透過訓練後調整(post-training)用於機器人學習。目前Agile Robots、Doosan Robotics、Siemens與Skild AI等夥伴正評估將Cosmos 3 Edge導入機器人工作流程。整體而言,Cosmos 3提供Edge(40億)、Nano(160億)與Super(640億)三種參數規模,讓開發者依部署需求選擇模型:
| Cosmos 3規模 | 參數量 | 定位 |
|---|---|---|
| Edge | 40億 | 邊緣裝置即時部署 |
| Nano | 160億 | 中階應用 |
| Super | 640億 | 高擬真度生成 |
Neil Ashton在演講中說明,NVIDIA Research與合作夥伴開發的最新模型架構,已能將Earth-2的模型檢查點壓縮至僅數百MB,達到百萬倍(a million-times)壓縮率,並可在一秒內產出具物理準確度的視覺化結果。
根據NVIDIA部落格報導,多家創意軟體業者於SIGGRAPH 2026同步宣布導入MCP(Model Context Protocol)標準:
五家業者的共通做法,皆是以MCP作為AI代理與各自軟體之間的標準介接層。
NVIDIA測試顯示,Synthetic Video Detector NIM微服務在未壓縮影片上的準確率達92%,影片經15%壓縮後降至87%,經50%壓縮後為82%。效能方面,該微服務在NVIDIA RTX系統上處理1080p影片最快僅需22毫秒,在NVIDIA L40 GPU上則約需30毫秒。
| 壓縮條件 | 辨識準確率 |
|---|---|
| 未壓縮 | 92% |
| 15%壓縮 | 87% |
| 50%壓縮 | 82% |
串流服務商Wowza已透過其Wowza Video Intelligence Framework嵌入這項微服務,將即時合成影片偵測帶入直播串流工作流程,應用範圍涵蓋超過35,000個部署、遍及170多個國家。
NVIDIA表示,新一代開放模型NVIDIA Nemotron 3 Ultra為5,500億(550-billion-parameter)參數模型,已針對DGX Station GB300系統優化,作為團隊可依自身領域客製化的模型層。
搭載其中的NVIDIA GB300 Grace Blackwell Ultra桌上型超級晶片,可提供高達20 petaflops的FP4 AI運算力與748GB相干記憶體,用以在桌面等級硬體上運行如Nemotron Ultra這類大型模型。網路方面,NVIDIA ConnectX-8 SuperNIC可提供高達800GB/s頻寬,並支援最多連接兩台DGX Station以擴展模型容量與效能。
NVIDIA DGX Station目前已由ASUS、Dell Technologies、Exxact、GIGABYTE、HP、MSI與Supermicro等廠商建置,並開放下單購買。
| DGX Station規格項目 | 數值 |
|---|---|
| Nemotron 3 Ultra參數量 | 5,500億 |
| GB300 FP4運算力 | 最高20 petaflops |
| 相干記憶體 | 748GB |
| ConnectX-8頻寬 | 最高800GB/s |
| 可連接站數 | 最多2台 |
NVIDIA部落格指出,MotionBricks是一款即時動作模型,訓練資料超過350,000個動作片段,運行速度可達遊戲引擎等級,讓創作者能指揮並串連角色動作。值得注意的是,驅動螢幕上動畫角色的同一套模型,也同步驅動了現場一台Unitree G1人形機器人,展示以電腦圖學與模擬技術加速物理AI(Physical AI)發展的做法。
根據NVIDIA部落格報導,NVIDIA在SIGGRAPH 2026共有21篇技術論文獲得接受,涵蓋即時系統如何生成虛擬世界、並帶動現實世界的機器訓練這一主軸。
綜合以上發表內容可見一致的技術路線:Cosmos 3以40億、160億、640億三種參數規模分層部署,搭配Earth-2百萬倍壓縮與Synthetic Video Detector在22至30毫秒內完成推論,指向NVIDIA將「即時」作為多項發表的共同標準;而DGX Station以5,500億參數的Nemotron 3 Ultra、20 petaflops運算力與748GB記憶體,為這些即時模型提供本地端運算基礎。同時,Adobe、Affinity、Boris FX、SideFX、Unreal Engine五家創意軟體業者同步導入MCP標準,與MotionBricks同時驅動螢幕角色和Unitree G1機器人的展示相互呼應,顯示NVIDIA將這場主題演講的21篇技術論文,定位為銜接虛擬內容生成與實體機器訓練的共同基礎。
根據 Intel 官方新聞稿,新墨西哥州 Rio Rancho 先進封裝廠已將 Reticle limit 擴大至業界標準 8 倍,預計 2028 年前達 12 倍以上;該廠員工數自 1980 年的 25 人成長至 2,700 人,並擁有 500 家供應商。
根據NVIDIA部落格文章,Vera Rubin NVL72較GB200 NVL72每百萬瓦最多提供10倍token吞吐量、成本降至十分之一;CoreWeave在DeepSeek-R1實測同樣測得10倍吞吐提升,Google Cloud A5X實例並顯示推理成本降至十分之一。
根據NVIDIA部落格報導,必治妥施貴寶(BMS)宣布部署第二座NVIDIA DGX SuperPOD,由8套DGX Vera Rubin NVL72系統組成,每兆瓦效能最高達現有系統10倍。新系統將與既有系統整合為全球統一平台,支援藥物發現流程的AI模型訓練與代理工作流程。