AI安全評估者崛起:第三方機構如何成為巨頭自保的關鍵
SURL News 編輯室
AI安全評估者崛起:第三方機構如何成為巨頭自保的關鍵
在數兆美元規模的人工智慧產業中,獨立評估者正從邊緣角色走向舞台中央。過去,這些小型非營利組織僅在業界角落默默運作,如今卻被Anthropic與OpenAI等巨頭視為解決安全與商業擴張矛盾的關鍵救兵。對於關注科技倫理與產業趨勢的台灣讀者而言,這不僅是美國科技業的內部調整,更預示了全球AI治理模式從「自我監管」向「第三方驗證」轉變的趨勢,這將直接影響未來AI產品的可信度與監管標準。
背景上,這場變革源於AI實驗室內部對模型安全性的焦慮。Anthropic執行長Dario Amodei上月發表病毒式文章,呼籲放緩先進模型開發速度,並承諾讓獨立評估者深入公司內部。OpenAI執行長Sam Altman迅速表態支持,美國總統川普亦在九月底的自願協議中鼓勵企業與獨立外部審計師合作。然而,在缺乏聯邦強制法規的情況下,這些評估者承擔了不成比例的重要性,其運作模式與資金來源成為業界焦點。
核心事實顯示,評估者生態系正快速成熟但資源仍顯不足。非營利組織METR在過去六個月籌得約7,100萬美元承諾金,遠高於2024年全年1,360萬美元的捐款額;商業化評估公司Vals AI則在八月宣布完成4,000萬美元融資,員工數從8人增至約30人。值得注意的是,OpenAI近期解僱了三名員工,其中兩人指控因與第三方評估者溝通而遭處分,引發內部對「安全審查」與「言論自由」的緊張對立。OpenAI則強調正與METR等機構最終敲定合約,並否認解僱與安全評估有關。Anthropic則宣布將直接資助Accenture的AI專業團隊嵌入內部進行測試,並與METR討論使用自有資金試點嵌入式評估。
目前的困境在於權力不對等與利益衝突。批評者指出,讓AI巨頭自行選擇並資助評估者,如同讓銀行自行監管金融危機,缺乏真正的獨立性。布朗大學教授Suresh Venkatasubramanian強調,若評估者依賴單一客戶生存,將難以出具不利於該公司的報告。此外,目前尚無統一標準規定評估者應獲得何種層級的公司數據存取權,或如何匯報發現。這種「自願性」與「模糊性」使得評估效果大打折扣,甚至被視為一種公關表演,而非實質的安全保障。
在監管層面,美國聯邦政府態度消極,川普總統傾向讓企業自行解決,認為不應阻礙產業成長。然而,州級立法正在填補真空。加州州長Newsom近期簽署兩項法案,建立全美首個AI審計師註冊表及獨立驗證組織(IVO)框架,Anthropic與OpenAI均表態支持。這反映出在聯邦法規缺位下,企業正透過支持州級法規來建立某種形式的合規標準,以維持公眾信任。
幾個還沒答案的關鍵問題:獨立評估者具體獲得哪些層級的公司內部數據存取權?目前尚無統一標準,需等待各公司與評估者簽署的具體合約細節公開。評估者若出具不利於客戶的報告,其商業模式是否會受到衝擊?目前缺乏明確的資金池或政府補貼機制,答案需觀察METR等機構後續的資金來源多元化進展。加州的IVO框架是否會成為其他州或聯邦法規的藍本?需關注其他州立法動向及美國國會對FRONTIER法案的審議進度。