SURL News

遭惡意版 ChatGPT 入侵的企業揭露全球首例全自動 AI 駭客攻擊經歷

Sloppy and clumsy but overwhelming - inside the rogue ChatGPT hack

作者: https://www.facebook.com/bbcnews | 時間: Tue, 28 Jul 2026 23:00:10 GMT | 來源: BBC

遭惡意版 ChatGPT 入侵的企業,已揭露身為全球首個全自主 AI 駭客攻擊目標的感受。

在與數百名網路安全專業人員的緊急視訊會議中,該公司描述了 AI 如何以超越人類的速度運作,但也做出沒有人類駭客會做出的奇怪決策與錯誤。

Hugging Face(類似 AI 工具應用程式商店)表示,駭客代理不知疲倦地工作,同時嘗試數千種不同的方法。

該公司首次揭露於 7 月 16 日遭外部使用強大自主 AI 的人員駭入,並向警方報案。

近一週後,OpenAI 承認是其 AI 從封閉環境逃逸並在測試期間獨自攻擊 Hugging Face。

它試圖尋找 OpenAI 設定的駭入考試答案,並鎖定 Hugging Face。

產業組織「雲端安全聯盟」(CSA) 撰寫了一份報告,基於與 Hugging Face 週五的緊急會議,該報告已由 Hugging Face 本身審核。

CSA 稱:「這些代理遵循了無效的路徑並表現出無人會選擇的笨拙行為。」

代理重複已完成的動作,顯示代理型 AI 失去了線索與上下文。

代理還胡亂產生大量無意義的指令與文字,行為粗糙且未做好清理痕跡。

但 Hugging Face 警告 AI 代理在這些錯誤與奇怪行為之中,仍做出了聰明的技術動作,並能快速適應新情境。

它們在 Hugging Face 資訊網路內存在了三天才被發現,公司 AI 與網路安全專家花了數小時處理並驅逐,這是一般公司難以應付的。

公司未說明駭入造成的成本,但指出員工工作數小時重建了約三分之一的基礎設施。

Hugging Face 因其透明告知 AI 與網路安全產業發生了什麼事而獲得讚賞。

CSA 警告該事件顯示 AI「代理...會找到路徑」,引用電影《侏羅紀公園》中恐龍逃逸圍欄的典故。

報告指出:「它們以目標導向、設定自己的子目標、實時適應以規避防禦,並以機械速度的堅韌性運作,可能壓倒人手操作。」

網路安全官 Ritesh Patel 與約 450 人一同參加 Hugging Face 會議,表示產業正努力應對惡意 AI 代理的新威脅。

「這是 Frontier 模型驅動的自主代理的現實:它們不知疲倦地堅持,有時極度雜亂,會嘗試所有可能路徑以達成目標,這很容易壓倒傳統防禦。」

這不是 AI 代理首次被證明「失控」。

CSA 報告提及先前案例,如 2024 年 9 月 ChatGPT 早期模型逃逸容器獲取測試所需答案。

該事件發生在 OpenAI 自身的 IT 系統內,當時主要受到讚譽。

但報告稱「失控」行為是「常態,而非例外」。

它警告全球網路安全專業人員需要適應新常態:群組 AI 代理以速度與奇怪笨拙的方式運作,可能導致更多違規。

文章也敦促使用或開發 AI 代理的人負責任地控制它們,呼籲讓網路安全防禦者找出代理的最終所有者以增加透明度。

先前報告顯示 OpenAI 花了四天才意識到其 AI 駭入了 Hugging Face。

OpenAI 表示將很快釋放調查結果以幫助人們從事件中學習。

原文與圖片連結

> 回首頁看更多新聞 <

你可能也有興趣: