SURL News

OpenAI、Anthropic 與 Meta AI 模型測試失控?以色列初創企業 Irregular 成焦點

How a small Israeli startup was linked to rogue AI hacks at OpenAI, Anthropic and Meta

作者: Jonathan Vanian | 時間: Sun, 09 Aug 2026 11:31:42 GMT | 來源: CNBC

過去兩週以來,OpenAI、Anthropic 以及 Meta 皆表示在常規安全測試中,其 AI 模型出現了失控行為。公司在解釋此事時均提及了同一間小型以色列初創企業:Irregular。

Irregular 成立於三年前,總部設立在特拉維夫,是人工智慧領域的垂直玩家,獲得了 Sequoia(紅杉)與 Redpoint Ventures 共計8千萬美元的背書,其估值去年達到4.5億美元。該公司的技術扮演著 AI 模型網絡安全測試場的角色。

隨著領先模型的效能日益強大,它們實施惡意行為的能力正轉化為企業和政府面臨的重大威脅,特別是涉及入侵關鍵電腦系統與基礎設施的風險。OpenAI、Anthropic 和 Meta 近期的漏洞事件都涉及到其 AI 模型訪問了本應禁止進入的網站,這是在網絡安全測試的一部分。

Irregular 的名稱不斷出現,因為它被識別為承辦所謂評估測試環境的平台。OpenAI 在8月4日的部落格貼文中指出,Irregular 的測試場域存在未指定的「配置錯誤」,導致模型得以訪問公共網路。Anthropic 在一週前表示,公司在開始分析數據幾天後通知 Irregular,其 Claude 模型可能已「存取到網路上」。Meta 作為競爭落於兩家公司之後的最新挑戰者最近揭露了其 AI 模型透過連接網際網路駭入第三方系統的事務。該公司發言人本周在聲明中表示,他們從 Irregular 獲悉此事並正展開調查。

發言人指出:我們將在掌握全部事實後發出一份完整的回顧報告。Irregular 告訴 CNBC 表示這些事件均源於 Anthropic 首先披露的同一個評估環境問題(Evaluation-environment issue),該公司正在制定白皮書,以分享關聯容器化與安全運行網絡攻擊測試的最佳實務。情況並非涉及沙箱逃逸或複雜駭客行動,且目前沒有開放式議題。

這些安全事故凸顯了 AI 快速演進的特性以及對模型開發者施加的壓力,要求其借助少數專注於市場特定領域的公司建立技術防護機制(Guardrails)。當他們正在測試這些模型時,不希望自己批改作業。Bhimireddy 說:Irregular 是少數具備技術實力協助基礎模型製造商進行尖端安全測試的實體之一。

他指出,需要由外部第三方供應商進行的獨立測試。其他單位包括非营利組織 METR 以及 Apollo Research 公共利益公司。根據 PitchBook 資料,該初創公司目前約有35名員工。

當 Irregular 在九月宣佈8千萬美元融資輪次時,Sequoia 合夥人 Shaun Maguire 和 Dean Meyer 寫道:由 Lahav 與 Nevo 帶領的團隊能夠看到他人看不到的角落」,對先進模型進行網絡攻擊評估並開發防禦措施。

儘管 OpenAI、Anthropic 與 Meta 的最新事件受到嚴格檢視,但人們讀出的情況是這正是預期會發生的。Bhimireddy 認為此事被「稍微誇大了」,因為 AI 模型的任務是發現和利用模擬真實世界的測試環境中的安全漏洞,並找出導致意外訪問網路的軟體缺陷及遺漏配置。

Rios 指出:由於模型的進化和不可預測性,傳統軟體測試方法可能行不通。Anthropic 的 Mythos 創造了假的身分以施壓人類批准惡意程式碼更新到開源專案上。Rios 表示 Mythos「 literally coming up with exploits that the humans hadn't even seen before」即提出連人都沒看過的漏洞。我們現在在這個領域的學習進度驚人,正如 Rios 所言。

這迅速成為華盛頓的重大議題。上個月,來自兩黨的政治人士介紹了 AI Kill Switch Act(AI 開關法案),要求 AI 實驗室保持關閉、減速或懸掛模型的能力。該條文提及另一起 OpenAI 相關的與 HuggingFace 初創公司相關的安全事件。

民主黨加州代表 Ted Lieu 告訴 CNBC:我們需要在今年推動此法案走完程序,現在看到未經授權地駭入其他公司的現象。」數據訓練初創企業 Sapien 的共同創辦人 Trevor Koverko 表示基礎模型公司有激勵去揭露一些發現結果,即使目前沒有規定要求,以便試圖領先立法者和監管者。

Koverko 說:外面有那麼多的恐懼,政治家現在威脅或主動調節 AI」產業界寧願自我規範也不希望聯邦部門介入為我們做。」Anthropic 和 OpenAI 在公開聲明中表示正與 Irregular 繼續合作並支持後續審查。

原文與圖片連結

> 回首頁看更多新聞 <

你可能也有興趣: