📰 重點摘要

Anthropic 對其強力模型採取分階段、受控釋出的策略,理由是新模型一旦公開,攻擊者可能比防禦者更快從中獲益。加密貨幣智庫Delphi Digital研究員蘇(Su,音譯)指出,如果新模型讓攻擊者的能力提升速度遠超過防禦者,實際上會傷害整個生態系,因此限定測試期有助於縮小潛在「爆炸半徑」。不過他也表示,一旦其他更強大的模型陸續釋出並廣泛流通,Anthropic將面臨壓力,必須讓自家模型更普及,屆時關鍵問題會是防禦方能否像攻擊方一樣有效部署這些前沿模型。Solana基金會資安長Michael Coates(7月加入)同樣支持安全防護機制,但主張應加快合法防禦者取得存取權限的流程,簡化驗證與核准程序。區塊鏈創投Blockchain Capital的Sean Cheetham則認為,長期應開放限制,因為合法資安研究人員的數量遠多於發動精密攻擊的小型組織,若能讓正派人士擴大防禦規模,開放存取反而更有利。文中提到,全球最大加密貨幣交易所幣安(Binance,資產總額達1,378億美元)目前並未取得前沿AI模型的存取權;加密貨幣託管商Fireblocks今年4月曾表示正在申請存取Anthropic的Mythos計畫,當時僅使用公開版模型進行滲透測試;Uniswap創辦人Hayden Adams則在6月批評Fable 5對網路資安相關提示詞的限制過於嚴格。以太坊基金會7月表示已運行「協同AI代理」在其系統中尋找漏洞,但未透露使用的模型。金融科技公司FIS(與Circle合作提供USDC支付服務)上月則加入了Anthropic的閘門式計畫Project Glasswing,取得了存取權限。


💬 JudyAI Lab 觀點

原文中,Anthropic對強力模型採階段式受控釋出,理由是新模型公開後攻擊者可能比防禦者更快受益。

這反映AI安全設計中的一個核心兩難:能力擴散速度若失衡,防禦方跟不上攻擊方,整個生態系都受害。Delphi Digital研究員蘇指出限定測試期能縮小「爆炸半徑」,但這治標不治本——只要更強模型陸續釋出,開放壓力遲早出現。Solana資安長Coates主張加快合法防禦者的存取審核流程,Blockchain Capital的Cheetham則認為長期該開放,因為正派資安研究者人數遠多於精密攻擊組織。幣安至今仍未取得前沿模型存取權,FIS則已加入Anthropic的Project Glasswing,顯示存取權本身正變成一種競爭優勢與資安落差來源。

對AI builder而言,這提醒我們:模型存取許可權的分配機制本身,已經是一項需要主動規劃的資安策略,而非事後才處理的問題。


📅 原文資訊


🔗 延伸閱讀