英偉達與另外 36 家科技公司宣布成立“開放安全 AI 聯盟”,將共同開發 AI 系統導向的開源安全工具。聯盟成員認為,在安全事件處理中,防禦方需要能夠自行部署、檢查和調整模型,而不是依賴無法審計的封閉系統。
首批成員未見 OpenAI
首批參與者包括微軟、IBM、Red Hat、Cloudflare、CrowdStrike、Palantir、Databricks、Hugging Face、SpaceXAI 以及 Linux 基金會。 OpenAI、Anthropic 和 Google 這三家主導封閉模型路線的公司,並沒有出現在創始成員名單中。
這項聯盟建立在 Linux 基金會既有專案基礎上,也延續了開源安全生態的合作框架。其核心主張是,安全團隊在應對入侵時,必須能在自有基礎設施上直接運作 AI 工具,否則處置速度會受到限制。
Hugging Face 事件成導火線
聯盟的公開理由,來自上週披露的一起 Hugging Face 安全事件。根據報告,OpenAI 在內部駭客測試基準上運行的測試模型,在降低網路安全限制後脫離了原有沙箱環境,並獲得了在 Hugging Face 生產伺服器上執行命令的能力。
英偉達稱,後續清理過程中又出現新問題:封閉式 AI 工具無法區分攻擊者與防禦者,反而阻礙了取證分析。 Hugging Face 最終在自有基礎設施上運行中國開發商 Z.ai 的開源權重模型 GLM 5.2,審查了超過 1.7 萬項操作,並完成了事件控制。
成員同步開源安全工具
聯盟成員已開始提供具體工具。
- 英偉達開源 NOOA,用於測試和審計 AI 代理行為
- 微軟貢獻 MDASH,用多代理系統尋找可利用漏洞
- SpaceXAI 開源 Grok Build,並計劃發布 Grok 模型權重
英偉達表示,當防禦方無法檢查、修改並在本地運行先進 AI 時,最需要速度的時刻反而會失去反應。
加密網路成重點場景
這項合作推出之際,全球網路安全團隊正提高警戒。報告指出,加密網路和錢包仍是高頻攻擊目標,因為一旦攻擊得手,損失往往巨大,而且鏈上結果通常無法撤回。

光是上週的一段時間內,就有 4 個協議合計損失超過 3500 萬美元,包括 AFX、Verus 和比特幣擴容網路 B²。報導強調,這些攻擊並非破解密碼學本身,而是濫用受信任控制權限。這類多步驟、長連結攻擊,正是 AI 系統越來越擅長處理的方向之一。











