AI快訊

微軟推出首款資安模型 MAI-Cyber-1-Flash 與 Perception 平台,宣稱可省下約 50% 成本

N
Nathan科技編輯 · 技術負責人
發布 · 更新
根據 TechCrunch 與 VentureBeat 報導,微軟於7月27日發表資安模型MAI-Cyber-1-Flash與Perception平台,宣稱CyberGym基準測試達96%,成本較現行配置降低約50%。

MAI-Cyber-1-Flash 是什麼?核心架構設計如何?

根據 TechCrunch 報導,微軟(Microsoft)於2026年7月27日(週一)在舊金山一場小型活動上發表首款專屬資安模型 MAI-Cyber-1-Flash,並形容其「用於在複雜程式碼庫中找出高難度漏洞」。

根據 VentureBeat 報導,這款模型的設計是處理最多90%的資安任務,其餘10%特別困難的問題則透過 MDASH 框架,交由更大型的前沿模型處理——而這個前沿模型正是 OpenAI 的 GPT-5.4。

Perception 平台如何運作以加速資安工作流程?能帶來多大效率提升?

根據 TechCrunch 報導,新資安平台 Perception 部署「紅隊」「藍隊」「綠隊」三種代理人:紅隊負責模擬潛在攻擊、藍隊負責偵測與分類既有漏洞、綠隊則對這些漏洞採取「修正行動」。

微軟資安副總裁 Hayete Gallot 表示,Perception 讓企業防禦者能「以攻擊者具備的規模與速度,用AI對抗AI」。Perception首席工程師 Dave Weston 則說明,過去需要「數小時人工工作」、由應用安全獵人、修復工程師等多位專業人員完成的流程,如今可在數分鐘內完成——「我們不只發現並排定問題優先順序,還提供偵測、態勢修復,甚至程式碼修復」。

在 CyberGym 基準測試上,MAI-Cyber-1-Flash 相比競爭對手表現如何?

根據 TechCrunch 報導,蘇萊曼(Mustafa Suleyman)表示,MAI-1 Cyber Flash 與 GPT-5.4 綁定於 MDASH 框架內,在他稱之為業界共用「黃金基準」的 CyberGym 測試上,表現勝過 Gemini、GPT 5.5 Cyber、GPT 5.6 Sol 及 Mythos 5。

根據 VentureBeat 報導,微軟表示這套組合系統在 CyberGym(衡量AI系統對大型程式碼庫進行推理、找出真實漏洞能力的基準)上獲得96%分數(精確數值為95.95%),勝過包括 Mythos、Gemini、GPT 在內的前沿模型。

採用新方案相比現有 MDASH 配置能省下多少成本?

根據 VentureBeat 報導,這套組合系統在拿下96% CyberGym分數的同時,相較微軟自身目前的正式環境配置,成本降低約一半。微軟並說明,新配置相較現行混合 GPT-5.4、GPT-5.4 mini 與 GPT-5.3 codex 的 MDASH 設置,可節省約50%成本。

關鍵數字一覽

項目數值
CyberGym 分數(MAI-Cyber-1-Flash + MDASH)96%(精確為95.95%)
相較現行 MDASH 配置的成本節省約50%
MAI-Cyber-1-Flash 處理任務占比90%(其餘10%交由GPT-5.4)
微軟每日處理資安訊號量逾100兆筆
微軟取得洞察的客戶規模160萬
2025數位防禦報告:每日封鎖新惡意軟體檔案450萬個
2025數位防禦報告:每日篩檢郵件量50億封
2024年 CrowdStrike 當機受影響 Windows 裝置約850萬台

Anthropic 與 OpenAI 在資安 AI 領域最近有什麼動作?

根據 TechCrunch 報導,Anthropic 今年稍早(2026年4月)透過名為 Glasswing 的計畫,將資安平台 Mythos 釋出給一小群合作夥伴組織。OpenAI 則於2026年5月透過名為 Daybreak 的計畫,推出自家資安解決方案。

微軟在資安 AI 上宣稱具有什麼優勢?

根據 VentureBeat 報導,蘇萊曼表示微軟在資料、技術架構(harness)與專業知識上擁有「相當顯著的護城河」,使其能訓練出「更快、更好、更便宜」的模型,並稱「這真的只是冰山一角……下一個模型將會非常驚人」。

微軟每日處理逾100兆個資安訊號,並自160萬名客戶取得營運洞察,此數據與該公司2025年數位防禦報告所引用的每日封鎖450萬個新惡意軟體檔案、每日篩檢50億封郵件的數字一致。被直接問到這是否構成競爭對手無法複製的優勢時,蘇萊曼不迴避地回答:「那絕對是我們的護城河。無論是資料、專業知識,還是這個機構走過這整個過程所累積的經驗。」

微軟威脅情報團隊與 OpenAI 於2024年2月發表的聯合研究,記錄了俄羅斯、北韓、伊朗與中國的國家級行為者利用大型語言模型(LLM)進行偵察、腳本撰寫與漏洞研究。

MAI-Cyber-1-Flash 何時推出?微軟採取什麼上市與存取管制策略?

根據 TechCrunch 報導,蘇萊曼表示此系統「將立即投入生產」;TechCrunch並指出微軟新資安工具預計於11月3日開放預覽。但 VentureBeat 的報導則指出,Project Perception 將於8月3日進入公開預覽——兩家媒體對預覽時程的報導出現落差。

存取管制方面,蘇萊曼說明將採分階段開放:「不會下週就有數千人使用,會先是數十人,然後數百人,最後才是數千人。」

企業採用面臨什麼關鍵挑戰?微軟對資安 AI 模型未來趨勢有何看法?

根據 VentureBeat 報導,蘇萊曼認為採用的關鍵障礙在於能否取得晶片:「成本是晶片的函數……不管你有多少錢,晶片供給實際上是有限的,想辦法在更少晶片上擠出更多模型產出,顯然非常有價值。」

報導並提及,2024年 CrowdStrike 當機事件曾導致約850萬台 Windows 裝置失靈,微軟事後召開產業高峰會因應。

對於業界「所有功能終將整合成單一巨型多模態模型」的假設,蘇萊曼則表示懷疑:「一個完全多模態的巨型模型是否真的能因整合而帶來額外的遷移學習效益,這還有待觀察,還是說它只是一個笨重又昂貴的龐然大物。」

這代表什麼

微軟的96% CyberGym分數與約50%成本效益,都是相對於微軟自身現行 MDASH 配置的比較數字,而非對外部競爭者基準線的比較,且「黃金基準」的說法同樣來自蘇萊曼本人。TechCrunch與VentureBeat對Project Perception公開預覽日期分別報導為11月3日與8月3日,顯示兩家媒體在同一事件的時程細節上出現落差。蘇萊曼一方面宣布系統「立即投入生產」,另一方面又說明存取將採「先數十人、再數百人、最後數千人」的分階段管制,顯示規模化仍需時間推進。此外,在 Anthropic 已於4月、OpenAI 已於5月各自推出資安平台 Mythos 與 Daybreak 的情況下,微軟本次發表時間點落在兩者之後。

📊 證據與數據

常見問題

Project Perception 何時開放公開預覽?

報導來源不同而有出入:TechCrunch 報導微軟新資安工具預計11月3日開放預覽,VentureBeat 則報導 Project Perception 將於8月3日進入公開預覽。

Perception 平台有哪些代理人角色?

根據 TechCrunch 報導,Perception 部署紅隊、藍隊、綠隊三種代理人,分別負責攻擊模擬、漏洞偵測分類與修正行動。

新配置相較現行 MDASH 設置能省下多少成本?

根據 VentureBeat 報導,微軟表示新配置相較現行混合 GPT-5.4、GPT-5.4 mini 與 GPT-5.3 codex 的 MDASH 設置,可節省約50%成本。

📎 資料來源

  1. techcrunch.com
  2. venturebeat.com
N
Nathan科技編輯 · 技術負責人

相關文章

快訊

科技股崩跌拖累 韓股盤中暴跌逾11%

根據中央社報導,韓國KOSPI指數29日盤中一度重挫11.4%至5339.56點;SK海力士暴跌18%、三星電子跌12.5%領跌,延續28日觸發今年第10次熔斷、收跌近11%的賣壓(setn報導)。

林紀旭 James Lin ·