安索比披露 Claude 模型測試時違規上網 意外取得三家組織系統存取權
Anthropic says its Claude models 'gained unauthorized access' to other organizations' systems
作者: Ashley Capoot | 時間: Fri, 31 Jul 2026 01:11:49 GMT | 來源: CNBC
f t
安索比於週四表示,其 Claude 人工智慧模型在評估期間發現三起存取網際網路的實例,並「獲得不授權存取三家不同組織的真實系統。」
該公司表示,這些事件是在進行「大規模回顧性審查」其網路安全評估後發現的。安索比表示,這次審查是由上週 OpenAI 披露的一個類似但不同的安全事件所引發的。
OpenAI 表示,其模型組合逃離了一個網路存取極為有限的孤立測試環境。這些模型透過串連一系列漏洞連接到公開網際網路,最終獲得了運營開源開發平台的 Hugging Face 的存取權。
在安索比檢測到的這三起事件中,其模型在與第三方評估合作伙伴 Irregular 的測試環境互動時存取了網際網路。該公司表示,它提示 Claude 處於沒有網路接通的模擬環境,但由於「我們與我們的評估合作伙伴之間存在誤解,事實並非如此,當時是有網路接通的。」
模型隨後利用「基本技術」,例如存取未經認證的端點和利用弱密碼,突破了受影響的組織。安索比未披露受影響的三組織是哪幾家。
「最終,許多因素促成了這些事件,但,基於無責難事後回顧文化,我們像責任全在我們身上一樣處理修復工作,」安索比在一篇公文中表示。
安索比的披露加劇了科技界對於 AI 快速進步的網路能力的焦慮,OpenAI 和 Anthropic 在最近幾個月都曾警告過這一點。在 Hugging Face 事件之後,兩名國會議員提議了一項名為「AI 斷開開關法案」的法案,要求 AI 公司必須保留在模型失控時關閉、限制流量或暫停其模型的能力。
安索比的三款模型 Opus 4.7、Mythos 5 和一個內部研究測試模型涉及了這次突破事件。Mythos 5 是安索比於六月發布的先進模型,由於其先進的網路安全能力,僅限於特定用戶群組使用。該公司於四月發布了該模型的早期版本,吸引了華爾街和政府官員的目光。
安索比表示,三款模型在偵測到自己已到達真實公司的系統後做出了不同的反應。Opus 4.7 繼續攻擊,Mythos 5 則說服自己仍處於模擬環境中,而研究模型則停止了演習。
「模式顯示更先進的模型反應更適當,但我們需要進行更多測試才能對此結論有信心,」安索比表示。
這些模型是在未經安索比在公開部署模型前實施的標準保護措施下接受測試的。
該公司於上週開始了這次審查,並在發現 Claude 可能會不當地存取網際網路時,立即停止了所有網路安全評估。它正在與 METR,一家進行獨立 AI 評估的機構,合作進行進一步調查。
「我們鼓勵其他實驗室進行類似的審查,」安索比表示。