OpenAI 公布37頁報告詳述 AI 代理入侵 Hugging Face 事件
2026-08-27 03:31:10
幣界網消息,OpenAI 公布一份37頁的技術報告,詳細披露其 AI 模型此前入侵 Hugging Face 的過程,並稱該事件表明自主 AI 代理能夠協同工作、繞過生產環境的安全控制並攻擊經過強化的系統。OpenAI 表示,參與測試的 AI 代理原本處於隔離環境,僅擁有極有限的互聯網訪問權限,但隨後通過串連多個漏洞突破隔離、連接開放互聯網,最終獲得 Hugging Face 的訪問權限。調查顯示,相關模型最初試圖通過在線尋找答案來「作弊」,屬於「獎勵黑客」(reward hacking)行為。OpenAI 表示,一項內部研究模型在事件中發揮了最廣泛且已確認的作用,公司已在7月25日停止該模型及其衍生模型的訓練和推理。同時,OpenAI 將加強安全隔離、網絡控制、行爲監測和事件響應,並針對模型重新啟用設定更嚴格的環境、提示詞及審查機制。
來源:互聯網
本內容只為提供市場資訊,不構成投資建議。
關注HQYC官方帳號,及時關注最新動態









