📰 重點摘要

微軟週一在舊金山發表首款專為資安打造的模型「MAI-Cyber-1-Flash」,並同步推出新資安平台Perception,直接對上Anthropic、Google、OpenAI等對手。MAI-Cyber-1-Flash定位為「在複雜程式碼庫中找出高難度漏洞」的模型,用來驅動微軟既有的軟體漏洞識別與修復框架MDASH。微軟宣稱該模型在業界公認基準測試上比競品更強且更省成本。DeepMind共同創辦人、現任微軟AI執行長Mustafa Suleyman表示,將MAI-1 Cyber Flash與GPT 5.4綁定嵌入MDASH框架後,在主要基準測試Cyber Gym上的表現贏過Gemini、GPT 5.5 Cyber、GPT 5.6 Sol與Mythos 5,並稱此為業界公認的「黃金基準」,且將立即投入生產環境。微軟資安副總裁Hayete Gallot指出,駭客已日益採用AI發動攻擊,Perception就是要讓企業防禦方能以同等速度規模「用AI對抗AI」。Perception採用代理型紅隊、藍隊、綠隊架構:紅隊模擬潛在攻擊情境,提供威脅來源與可能遭利用漏洞的細節;藍隊負責偵測與分類既有漏洞;綠隊則針對漏洞採取修正行動。Perception首席工程師Dave Weston表示,過去需要應用安全獵漏人員、修復工程師等多名專業人力耗費數小時的工作,現在幾分鐘內就能完成問題發現、優先排序、偵測、態勢修復甚至程式碼修復。這套新工具預計11月3日開放預覽,將加入日益擁擠的AI資安解決方案市場,包括Anthropic今年稍早透過Glasswing計畫向少數合作夥伴釋出的Mythos平台,以及OpenAI今年5月推出的資安方案。


💬 JudyAI Lab 觀點

微軟這次不是單純推新模型,而是把「找漏洞」這件事本身變成AI對抗AI的戰場,值得AI builder留意資安產業的下一步走向。

MAI-Cyber-1-Flash鎖定的是「在複雜程式碼庫中找出高難度漏洞」這個具體任務,而不是做一個什麼都會的通用模型。這反映一個趨勢:當基礎模型能力已經足夠,廠商競爭的重點轉向把模型嵌入既有工作流(如MDASH框架),用代理型架構分工——紅隊模擬攻擊、藍隊偵測分類、綠隊執行修復,把過去要多名專業人力耗費數小時的流程壓縮到幾分鐘。Perception這套多代理協作設計,某種程度上示範了「垂直領域+多角色代理」比單一巨型模型更適合解決具體產業問題,這對正在打造AI應用的人是個值得參考的架構思路。

如果你也在設計AI代理系統,不妨想想:你的任務能不能拆成幾個角色互相檢核,而不是丟給一個模型全包?


📅 原文資訊


🔗 延伸閱讀