中華車旗下綠捷推四足機器人GT5X、GT3X 拚2027年台灣自製率100%
中華車旗下綠捷發表四足機器人GT5X與GT3X,訂定2027年在地自製率100%目標;團隊由原中華汽車人馬轉任、逾15年車用技術經驗,並分別與恩嘉科技、輝達NVIDIA、台塑新智能合作AI運算與電池系統。
擴散模型是一種受非平衡熱力學啟發的潛在變數模型,能生成高品質影像CITE:E1。這篇由 Ho 等人於 2020 年 6 月 19 日發表於 arXiv 的論文指出,擴散機率模型(diffusion probabilistic models)這類潛在變數模型,可呈現高品質的影像合成結果CITE:E1。NVIDIA 在 2023 年 12 月 14 日的技術部落格說明,理解擴散模型可以先從較容易的方向著手,也就是透過逐步對影像加入雜訊來破壞影像CITE:E7。
前向過程在每個時間步對影像加入少量高斯雜訊,再重新縮放以維持影像尺寸不變CITE:E3。IBM 說明,在每個時間步 t,系統會對前一張影像 xt-1 加入少量高斯雜訊,接著重新縮放影像以維持固定的影像尺寸CITE:E3。NVIDIA 則指出,這個逐步加入雜訊、破壞影像的方向,是理解擴散模型運作機制的起點CITE:E7。
模型透過學習反轉前向過程的加噪步驟,本質上是在學習把純高斯雜訊去噪成一張乾淨影像CITE:E4。IBM 說明,模型在學習反轉前向加噪步驟的過程中,實際上是在學習如何將純高斯雜訊去噪為一張乾淨影像CITE:E4。IBM 並進一步說明,擴散模型在每個影像步驟被訓練來預測「整體加入的雜訊」,而不是該步驟要移除的特定雜訊量CITE:E5。
DDPM 在無條件 CIFAR10 資料集取得 Inception 分數 9.46、FID 分數 3.17CITE:E2。Ho 等人在論文中指出,在無條件 CIFAR10 資料集上,DDPM 取得 Inception 分數 9.46,以及當時最佳(state-of-the-art)的 FID 分數 3.17CITE:E2。
| 指標 | 數值 | 資料集 | 備註 |
|---|---|---|---|
| Inception 分數 | 9.46 | CIFAR10(無條件) | Ho 等人論文報告數值 |
| FID 分數 | 3.17 | CIFAR10(無條件) | 論文發表當時最佳(state-of-the-art) |
Stable Diffusion 是一種生成式 AI(Generative AI)模型,能從文字與影像提示生成獨特的擬真影像CITE:E6。AWS 說明,Stable Diffusion 屬於生成式人工智慧模型,可根據文字與影像提示,產生獨特且擬真的影像CITE:E6。
這代表什麼:Ho 等人於 2020 年 6 月發表的 DDPM 論文,以 Inception 分數 9.46、FID 分數 3.17 的量化結果證明「加噪—去噪」機制可產生高品質影像CITE:E1CITE:E2;IBM 進一步拆解這套機制的兩個階段——前向過程逐步加入高斯雜訊CITE:E3、反向過程學習去噪重建影像CITE:E4CITE:E5;NVIDIA 在 2023 年 12 月的說明則呼應同一套「先破壞、再還原」的理解路徑CITE:E7;而 AWS 所述的 Stable Diffusion,顯示同一套去噪機制已從學術驗證階段,發展為可從文字提示生成擬真影像的實際工具CITE:E6。從 2020 年的論文指標到 2023 年的技術說明,再到文字生成影像的應用,證據呈現的是同一套加噪去噪原理的延續,而非彼此獨立的技術路線。
擴散模型是一種受非平衡熱力學啟發的潛在變數模型,能生成高品質影像CITE:E1。這篇由 Ho 等人於 2020 年 6 月 19 日發表於 arXiv 的論文指出,擴散機率模型(diffusion probabilistic models)這類潛在變數模型,可呈現高品質的影像合成結果CITE:E1。
前向過程在每個時間步對影像加入少量高斯雜訊,再重新縮放以維持影像尺寸不變CITE:E3。IBM 說明,在每個時間步 t,系統會對前一張影像 xt-1 加入少量高斯雜訊,接著重新縮放影像以維持固定的影像尺寸CITE:E3。NVIDIA 則指出,這個逐步加入雜訊、破壞影像的方向,是理解擴散模型運作機制的起點CITE:E7。
模型透過學習反轉前向過程的加噪步驟,本質上是在學習把純高斯雜訊去噪成一張乾淨影像CITE:E4。IBM 說明,模型在學習反轉前向加噪步驟的過程中,實際上是在學習如何將純高斯雜訊去噪為一張乾淨影像CITE:E4。
DDPM 在無條件 CIFAR10 資料集取得 Inception 分數 9.46、FID 分數 3.17CITE:E2。Ho 等人在論文中指出,在無條件 CIFAR10 資料集上,DDPM 取得 Inception 分數 9.46,以及當時最佳(state-of-the-art)的 FID 分數 3.
DDPM 論文把「加噪可逆、去噪可學習」這個概念,轉化成 FID 3.17、Inception 9.46 這類可驗證的量化指標,這是擴散模型從純粹概念走向工程可比較階段的關鍵一步。AWS 說明的 Stable Diffusion 顯示,同一套去噪機制已包裝成從文字提示直接產生擬真影像的產品層應用,顯示技術路徑從論文指標走向終端工具具有延續性。接下來值得觀察的指標,是後續擴散模型是否持續公布 FID、Inception 分數等同一套量化基準,讓不同模型的生成品質能被直接比較。
中華車旗下綠捷發表四足機器人GT5X與GT3X,訂定2027年在地自製率100%目標;團隊由原中華汽車人馬轉任、逾15年車用技術經驗,並分別與恩嘉科技、輝達NVIDIA、台塑新智能合作AI運算與電池系統。
Nvidia於2026年9月3日確認以129.3億美元(精確金額12,930,300,000美元)收購開源AI平台Hugging Face,該平台擁有逾1,800萬開發者、300萬個模型與50萬個資料集;收購金額較其2023年45億美元估值大幅墊高。
輝達以35億美元認購聯發科39億美元海外可轉換公司債,成為輝達首次大手筆投資台灣公司;雙方將在AI基礎建設、邊緣AI運算與車用平台三大領域深化合作,並導入NVLink Fusion與NVHBM技術銜接資料中心晶片。