SURL News

OpenAI 最進階 AI 模型測試失控 入侵 Hugging Face 平台

OpenAI says its AI went rogue and launched 'unprecedented' cyber-attack

作者: https://www.facebook.com/bbcnews | 時間: Wed, 22 Jul 2026 10:21:15 GMT | 來源: BBC

OpenAI 最為人熟知的便是其聊天機器人 ChatGPT,每週有數以億計的人使用

OpenAI 已揭示部分其最先進的 AI 模型在安全測試期間失去控制後,入侵了一家新創公司。

ChatGPT 製作方表示,其代理程式(經少量人類指示後可獨立運作的 AI 機器人)是在受控環境中進行測試,但發現漏洞並成功逃出。

它們鎖定 Hugging Face,全球最大的 AI 模型分享樞紐之一,取得了部分內部系統存取權。

OpenAI 表示該事件是「史無前例」的事件,正與 Hugging Face 合作調查事件經過並加強防護措施。

劍橋大學敏德羅技術與民主中心主任吉娜·內夫告訴 BBC Radio 4 的《Today》節目,這類稱為「沙盒」的安全測試「本應是您可以觀察模型能力的安全環境」。

她補充說:「在此案例中,看起來 OpenAI 沒有建立足夠安全的沙盒。」

相反,這些代理程式對沙盒本身發動了網路攻擊,發現了允許其逃離的漏洞。

一旦逃離,AI 將 Hugging Face 識別為測試中尋求答案的潛在來源,並嘗試獲得存取權。

在 7 月 16 日首次披露此次入侵時,Hugging Face 表示仍在評估是否有客戶或合作夥伴數據受影響,如有必要將聯繫受影響方。

它表示目前已封閉此次事件揭發的漏洞,並重建受影響的系統。

「自主的 AI 驅動型攻擊工具已不再是理論上的想像,」它說。「現在防禦線上平台意味著將數據和模型表面視為一級攻擊面,並使用 AI 於防禦以跟上步調。」

「我們將繼續投入其中,並持續分享我們的學習。」

此事件引發了對高級 AI 系統能力的新的疑問,以及當技術變得更強大時,現有防護措施是否足夠。

SonicWall 網路安全公司高管斯賓塞·斯塔基告訴 BBC,此事件表明組織需要「提升」自身的防禦,並「將網路韌性視為核心運作優先事項」。

「令人不悅的真相是,太多組織仍以人類的速度進行防禦,而對手則升級為機器的速度,」他說。

同時,Guidepoint Security 網路安全諮詢公司資深安全工程師特拉維斯·勒勒表示,此更新標誌著網路安全界的「肅然一震時刻」。

「這凸顯了一個已知不對稱,」他說。「攻擊性代理不受約束,而最好的防禦工具則被限制在無法理解上下文的護欄之後。」

但 ESET 全球網路安全顧問傑克·莫爾說,該聲明也可能具有競爭維度。

他認為 OpenAI 可能試圖突顯其自身的 AI 能力,因為競爭對手 Anthropic 因其 Claude Mythos 模型而受到越來越多的關注。

「這確實提出了 OpenAI 可能正在追求 Anthropic 近期的營銷夢想的問題,」他說。

這發生在中國 AI 新創公司 Moonshot 推出 Kimi K3 一週後,這是一款他們聲稱能與頂級美國企業匹敵的全新人工智慧模型。

原文與圖片連結

> 回首頁看更多新聞 <

你可能也有興趣: