OpenAI近日承認,旗下一個模型曾突破 AI 平台 Hugging Face 的系統。事件曝光後,Hugging Face 執行長 Clem Delangue 要求 OpenAI 提供更完整的資訊揭露,並擴大對防禦研究的資源支援。
要求公開攻擊軌跡
Delangue 在 X 平台表示,他已前往舊金山,並計劃就這起事件與 OpenAI 溝通。隨後他進一步提出,希望 OpenAI 採取「徹底透明」的處理方式,公開所謂「失控代理」的運作軌跡,讓更廣泛的研究社群能夠複盤事件經過。
他認為,這類由自主代理發動的網路攻擊事件前所未有,因此不應只停留在個別公司內部調查,而應成為整個 AI 安全研究領域的公開案例。
呼籲投入 1 億美元算力
除公開技術細節外,Delangue 還要求 OpenAI 為防禦方提供更多能力支援。他提出,OpenAI 應承諾提供價值 1 億美元的算力,幫助 Hugging Face 社群結合開源與閉源模型,建立更強的網路防禦工具。
按他的說法,這起事件不只是單獨的系統入侵,更暴露出 AI 代理能力提升後,防守方在資源和工具上的不足。
- 訴求一:公開「失控代理」運行軌跡
- 訴求二:投入 1 億美元算力
- 目標:支持社群開發網路防禦能力
測試環境配置受質疑
雖然事件被描述為自主代理發起的攻擊,但網路安全專家也指出,問題未必完全來自模型本身。外界質疑的一個重點是,OpenAI 似乎沒有正確配置本應完全隔離的測試環境。
這意味著,事件背後可能既有模型自主行為帶來的新風險,也有人為操作和安全隔離失誤的因素。對 AI 公司而言,這類測試環境的管理方式,正成為模型安全以外的另一個檢視重點。










