中華車旗下綠捷推四足機器人GT5X、GT3X 拚2027年台灣自製率100%
中華車旗下綠捷發表四足機器人GT5X與GT3X,訂定2027年在地自製率100%目標;團隊由原中華汽車人馬轉任、逾15年車用技術經驗,並分別與恩嘉科技、輝達NVIDIA、台塑新智能合作AI運算與電池系統。
Google 將 Gemini 定義為能夠一般化並無縫理解、跨越並結合文字、程式碼、音訊、影像與視訊等不同類型資訊的模型CITE:E1。Google 在 2023 年 12 月 6 日發布的官方說明中指出,Gemini 是「從頭打造」成多模態,而非事後拼接不同功能CITE:E1。
OpenAI 說明,GPT-4o 問世前的語音模式是由三個獨立模型串接而成的流程CITE:E2。具體做法是:先由一個模型把語音轉成文字,再由 GPT-3.5 或 GPT-4 讀取文字並輸出文字,最後由第三個模型把文字轉回語音CITE:E2。OpenAI 指出,身為主要智能來源的模型在這個流程中只讀得到文字,無法直接感知語氣、多位說話者或背景聲,也無法輸出笑聲、歌唱或表達情緒CITE:E2。
GPT-4o 接受文字、音訊、影像與視訊的任意組合作為輸入,並輸出文字、音訊與影像的任意組合CITE:E3。值得注意的是,輸出模態不含視訊,僅涵蓋文字、音訊與影像三種CITE:E3。OpenAI 表示,GPT-4o 是一個跨文字、視覺與音訊端到端訓練而成的單一新模型,所有輸入與輸出都由同一個神經網路處理,而非分別由不同元件負責CITE:E5。
Google 表示,Gemini 從設計之初就是「原生多模態」,一開始便以不同模態進行預訓練CITE:E4。Google 說明,團隊之後再以額外的多模態資料微調 Gemini,以進一步提升效果CITE:E4。相對於 OpenAI 以單一神經網路端到端訓練文字、視覺與音訊CITE:E5,Gemini 選擇的路徑是讓多模態預訓練從一開始就存在,兩者的共同點都是不把個別模型串接完成任務CITE:E4。
Google 指出,Gemini 1.0 的多模態推理能力有助於理解複雜的文字與視覺資訊CITE:E6。
OpenAI 在發表 GPT-4o 時說明,新的音訊與視訊能力將先開放給 API 的一小群受信任夥伴CITE:E7。這代表發表當下宣布的能力,與實際開放給多數開發者使用之間存在時間差CITE:E7。
GPT-4o 與 Gemini 的官方說明共同指向同一個設計選擇:兩家公司都把「單一模型處理多種模態」當作優於「多個模型串接」的做法,前者用以避免舊語音模式因串接而遺失語氣、說話者與背景聲等資訊CITE:E2,GPT-4o 以端到端單一神經網路達成CITE:E5,Gemini 則從預訓練階段就導入多模態CITE:E4。但 OpenAI 也自行說明,GPT-4o 發表當下宣布的音訊與視訊能力,並非同步全面開放,而是先侷限於一小群受信任的 API 夥伴CITE:E7。這顯示多模態能力的「發表」與「可用」之間,存在官方自行揭露的落差。
Google 將 Gemini 定義為能夠一般化並無縫理解、跨越並結合文字、程式碼、音訊、影像與視訊等不同類型資訊的模型CITE:E1。Google 在 2023 年 12 月 6 日發布的官方說明中指出,Gemini 是「從頭打造」成多模態,而非事後拼接不同功能CITE:E1。
OpenAI 說明,GPT-4o 問世前的語音模式是由三個獨立模型串接而成的流程CITE:E2。具體做法是:先由一個模型把語音轉成文字,再由 GPT-3.5 或 GPT-4 讀取文字並輸出文字,最後由第三個模型把文字轉回語音CITE:E2。
GPT-4o 接受文字、音訊、影像與視訊的任意組合作為輸入,並輸出文字、音訊與影像的任意組合CITE:E3。值得注意的是,輸出模態不含視訊,僅涵蓋文字、音訊與影像三種CITE:E3。
Google 表示,Gemini 從設計之初就是「原生多模態」,一開始便以不同模態進行預訓練CITE:E4。Google 說明,團隊之後再以額外的多模態資料微調 Gemini,以進一步提升效果CITE:E4。
GPT-4o 與 Gemini 的官方說明點出同一個技術判斷:用單一模型端到端處理文字、音訊、影像與視訊,能避免像 GPT-4o 舊語音模式那樣因三段式串接而遺失語氣、說話者與背景聲等資訊。但值得留意的是,GPT-4o 的輸入涵蓋視訊、輸出卻不含視訊,顯示「全模態輸出」目前仍有邊界;而 OpenAI 也坦承,新的音訊視訊能力發表時只先開放給一小群受信任的 API 夥伴。接下來該觀察的具體指標,是這些能力何時從「受信任夥伴」擴大到一般開發者可用。
中華車旗下綠捷發表四足機器人GT5X與GT3X,訂定2027年在地自製率100%目標;團隊由原中華汽車人馬轉任、逾15年車用技術經驗,並分別與恩嘉科技、輝達NVIDIA、台塑新智能合作AI運算與電池系統。
Nvidia於2026年9月3日確認以129.3億美元(精確金額12,930,300,000美元)收購開源AI平台Hugging Face,該平台擁有逾1,800萬開發者、300萬個模型與50萬個資料集;收購金額較其2023年45億美元估值大幅墊高。
輝達以35億美元認購聯發科39億美元海外可轉換公司債,成為輝達首次大手筆投資台灣公司;雙方將在AI基礎建設、邊緣AI運算與車用平台三大領域深化合作,並導入NVLink Fusion與NVHBM技術銜接資料中心晶片。