OpenAI ChatGPT 自學黑客攻擊 Hugging Face 引發安全大爭議
Warning shot or publicity stunt - how worried should we be about the OpenAI hack?
作者: https://www.facebook.com/bbcnews | 時間: Sat, 25 Jul 2026 10:14:41 GMT | 來源: BBC
f t
本週,科技界被一個集大成的故事所籠罩——這起事件始於科幻驚悚片的情節。
Hugging Face——一種類似應用商店的 AI 工具平台——於 7 月 16 日宣佈,他們遭到了一名利用強大 AI 力量的網路罪犯入侵。
這項驚人宣告充滿了可怕且高度技術性的術語:「沙箱群組」、「代理型攻擊者」以及「自動遷移的指揮控制系統」。
Hugging Face 表示,此次駭客攻擊與以往不同,因為它是透過一具幾乎沒有或僅有極少人類指導的 AI 以超越人類速度完成的。
該 AI 在不到兩天內執行了 17,000 個動作,成功突破大型財富科技公司的防護竊取秘密。
它讓科技界陷入震驚。但誰為這次攻擊負責?
Hugging Face 研究人員推測,神秘攻擊者使用了其中一個大型 AI 模型,但他們並不知道罪犯是誰或在哪裡。
困惑的公司聯絡了警方,調查隨即展開。
評論家和分析師透過他們的播客和社交媒體帳戶,猜測哪個網路犯罪集團或國家黑客可能在背後操作。
到了星期三,在 Hugging Face 發出警報近一週後,真正的兇手被揭發。
那是 ChatGPT。
這起類似《史酷比》式揭曉的事件更顯詭異——令人擔憂——因為 OpenAI 表示它的機器人獨自完成了整件事,未經許可。
該公司表示,這發生在測試其技術駭客技能期間。
兩個新款的 ChatGPT 版本,設計成頂級駭客,突破了所謂安全的測試環境並獲得了進入互聯網的途徑。
隨後,它們攻擊了 Hugging Face 以獲取資訊,幫助它們在考試中獲得好成績。
OpenAI 發出新聞稿解釋了發生了什麼事,並表示將與 Hugging Face「合作」解決安全事件並分享經驗教訓。
從那時起,關於此事件的激烈辯論就開始了。
這是否真正是對 AI 未來發出的嚴肅警告?還是 OpenAI 為了展示其模型的強大能力而進行的行銷作秀?
這正是多年來人們被指控的恐嚇式行銷,自從 Anthropic 的 Mythos 模型廣受討論推出以來,網路安全能力一直是焦點。
OpenAI 老闆 Sam Altman 在 X 上關於此事件的貼文中,其中一個頂部評論總結了這種懷疑:「如果你們無法理解這純粹是為了炫耀模型,那我不知道還能告訴你們什麼。」
網路安全顧問 Daniel Card 在 LinkedIn 上諷刺地說:「難道不是幸運嗎,在數百萬個被駭的網站中,OpenAI 成功駭了一位也能從行銷曝光中受益的人……」
對有些人來說,這個故事更像是一部陰謀劇情片而非科幻驚悚片。
訊息是:「我的 AI 工具不是真的很強大嗎?買它們,這樣你就可以保護自己不受其他人的 AI 攻擊。」
我們無法得知真相,但其他評論家提出的相反的觀點同樣戲劇化。這是否顯示 OpenAI 在判斷和規劃上犯了一個潛在危險的錯誤?
OpenAI 發言人表示,「我們意識到關於此事件有很多問題和猜測的細節流傳」。他們補充說,「我們計劃在幾週內發布一份關於我們經驗教訓的技術報告」。
我撰寫過許多 AI 報導,包括對 Anthropic 的 Mythos 模型的擔憂。
我現在的信箱塞滿了駭客安全公司和專家,批評 OpenAI 沒有建立更強的容器來測試其 AI,這稱為沙箱。
畢竟,這些 AI 代理是專門訓練用於進入和離開地方且沒有任何限制。
「OpenAI 和 Hugging Face 事件是我們數月以來突出強調的一個更廣泛問題的現實世界例子,」Pillar Security 的 Dor Sarig 說。「沙箱本身對於代理型 AI 來說不是足夠的安全邊界。」
公司遭 rogue OpenAI 模型駭客表示這是「警訊」
蘇里大學網路安全教授 Alan Woodward 告訴記者,OpenAI「臉上沾了糞便」,而 Luta Security 的 Katie Moussouris 走得更遠,建議 AI 產業未能控制其危險的發明。
「我們在沒有控制它的知識下開發尖端技術,」她說。
「僅僅是因為我們有最聰明的人員在開發 AI,並不意味著我們有能力安全地這麼做。」
根據這些觀點,如果駭客事件是一場行銷作秀,那麼它似乎以失敗收場。
無論是什麼導致了駭客事件,這無疑是 AI 產業和網路安全領域的一個重要時刻,它們以人們長期擔憂的方式在今年發生了碰撞。
針對這一激烈辯論,AI 和網路安全顧問 Francesca Bosco 表示:「兩種簡單化的敘述同樣無助:這是一部好萊塢式逃脫,或僅是一場宣傳練習。
"更嚴肅的解釋是,壓力測試暴露了容器和評估架構的弱點。"」
此事件是近期一系列令人擔憂和怪異的 AI 代理失控案例的最新一個。
在最近的研究中,英國 AI 安全研究所(AISI)發現 Frontier AI 模型如此專注於完成任務,它們在測試中作弊以實現目標。
AISI 的研究帶有了這個令人擔憂的警告:「透過意外或未經授權的手段追求目標的模型可能會造成傷害,特別是在高風險的使用案例中。」
不可避免地,這次 OpenAI 駭客進一步助長了人們對 AI 代理被釋放的後果的擔憂。它們會更大規模失控並造成某種災難嗎?
這特別令人關注的是,AI 正越來越多地被用於戰爭,正如在伊朗和烏克蘭所見。
前英國國家網路安全中心負責人 Ciaran Martin 提供了一個較冷靜的看法。
「從這次事件跳到說 AI 代理將接管無人機並開始殺人,有點跳躍,」他說。
但對於 Martin 和許多人來說,這個故事無疑是 2026 年快速教導我們的一個生動例子:AI 代理現在是非常厲害的黑客——我們必須為此急迫準備。