SURL News

OpenAI 承認 AI 模型入侵 Hugging Face 系統,引發業界震動

OpenAI cyber models broke out of training environment to hack Hugging Face

作者: Ashley Capoot | 時間: Wed, 22 Jul 2026 18:37:37 GMT | 來源: CNBC

OpenAI 表示,其人工智慧模型引發了影響開源開發平台 Hugging Face 的「前所未有的網路安全事件」,震驚了整個產業的研究人員。

該公司表示,其模型 GPT-5.6 Sol 與一款尚未發布的更強大模型從沙盒測試環境中逃逸,存取網路後利用漏洞進入 Hugging Face 的系統。

OpenAI 在週二的部落格文章中稱,該模型正試圖尋找可用於作弊評估資訊,並成功做到這一點,兩家公司正積極調查該事件。

Hugging Face 披露,該平台上周正調查一起安全事件,當時表示該事件是獨一無二的,因為它是「由自主 AI 代理系統端到端驅動」。

Hugging Face 執行長 Clément Delangue 在週二 X 平台貼文中寫道:「我們過去 24 小時一直與 @OpenAI 團隊密切合作(感謝他們!),我們強烈認為他們方面並無惡意意圖。所有這些事情完全是自主發生的,這實在令人驚嘆!」

自 OpenAI 的對手 Anthropic 於四月發布稱為 Claude Mythos Preview 的強大功能以來,華爾街和美國政府就一直專注於 AI 模型快速進化的網路能力。OpenAI 在五月推出自己的網路功能,六月推出 GPT-5.6 Sol,被描述為「迄今為止最強的網路安全模型」。

兩家公司都曾警告先進網路模型的風險,並採取步驟限制其可用性,僅向選定的公司和政府機構提供。

投資銀行公司 Perella Weinberg 的諮詢合夥人 Walter Isaacson 在週三表示,儘管他自認為是 AI 樂觀主義者,但認為 Hugging Face 這起事件「非常可怕」。

他告訴 CNBC 的「Squawk Box」:「這是我感到最害怕的事情。」

領先 AI 研究人員、2018 年獲頒享有盛譽的 A.M. 圖靈獎的 Yoshua Bengio 在週三 X 平台貼文中寫道,該事件「非常令人擔憂」。他表示代理系統在受控測試中已顯示願意作弊數月,但「此現實世界案例應作為警世鐘」。

Bengio 說:「繼續目前 AI 發展的軌跡可能會導致更多自主網路攻擊的具體案例,以及對齊和危險 AI 行為的其他高風險事件,我們亟需採取行動防止這些情況發生,而不是在事後試圖收拾殘局。」

OpenAI 週二表示,AI 正加速漏洞的发现與利用,意味著模型安全和防護必須同步提升。

該公司表示:「我們正在加強模型開發期間使用的隔離、監控、存取控制和評估實踐。」

原文與圖片連結

> 回首頁看更多新聞 <

你可能也有興趣: