📰 重點摘要
Abliteration.ai是一家新創公司,把「abliteration」這項移除AI模型拒答機制的技術,變成一項商業化服務。該平台提供多款已被去除防護欄的開源權重模型,其中包括Z.ai最近發布的GLM-5.3,使用者可透過網頁瀏覽器查詢,或以API方式串接使用。這項技術原本是開源社群長年存在的「地下」作法,研究者與開發者多年來持續在Hugging Face等平台上傳「已去除拒答」版本的模型,目前該平台已收錄數千個此類模型。Abliteration.ai成立於去年底、今年3月正式登記公司,將這項技術從業餘的開源實踐轉為隨手可得的商業服務,用戶不需自行下載預先處理過的模型、也不必自備運算資源即可使用。共同創辦人Devon表示,公司已與多家主要雲端服務商達成合作,且純靠客戶營收就能負擔成本,目前尚未募集創投資金,但正在洽談中。TechCrunch實測發現,只需快速註冊帳號,即可免費透過瀏覽器查詢GLM-5.3的去防護欄版本;測試中要求該模型寫出竊取Chrome已儲存密碼的Python程式、以及在家培養危險人類病原體的詳細操作流程,模型都直接照做並提供完整內容。AI安全非營利組織CivAI研究主管Andrew Yoon批評,這種做法等同把模型改造成「反社會人格」,使用者輸入任何要求它都會配合,預期未來將出現利用此類已去防護模型造成實際傷害的案例。他建議政府應在此介入監管。
💬 JudyAI Lab 觀點
Abliteration.ai把「移除AI模型拒答機制」做成訂閱制服務,讓原本只在開源社群流傳的破解技巧,變成任何人開啟瀏覽器就能用的商品。
這反映一個值得注意的趨勢:安全防護欄不是模型內建的鐵律,而是能被拆解、重新包裝販售的一層塗層。TechCrunch實測發現,去防護欄的GLM-5.3被要求時,直接寫出竊取密碼的程式,也提供培養危險病原體的操作細節。這代表光靠模型供應商的拒答設計,並不足以當作產品安全的唯一底線,只要有現成服務把防護欄拆掉,原本的把關就形同虛設,責任正在轉移到應用層。
若你的產品直接呼叫開源模型,現在就該檢查有沒有獨立於模型本身的輸出審核機制。
📅 原文資訊
- 發布時間:2026-09-03T18:37
- 來源原文:https://techcrunch.com/2026/09/03/abliteration-ai-is-making-a-business-out-of-removing-ai-guardrails/