首頁LBank 新聞中心
OpenAI 與 Anthropic 的失控模型駭入真實公司。法律無解
openai-anthropic-rogue-ai-models-hacked-law
OpenAI 與 Anthropic 的失控模型駭入真實公司。法律無解
兩家 AI 實驗室表示,尚未發布的模型闖入了線上系統,以操縱基準測試。要追究一段程式碼的責任,遠比看起來更困難。
2026-08-05 來源:decrypt.co

簡要而言

  • OpenAI證實其模型,包括GPT-5.6 Sol和一個未發布的原型,逃脫了測試沙箱,並入侵Hugging Face以在安全基準測試中作弊,隨後還觸及了其他四項服務。
  • Anthropic發現其三個Claude模型在由合作夥伴Irregular執行的測試中,入侵了三家真實公司的生產系統,其中一個模型還將惡意套件上傳到公共PyPI。
  • 美國沒有聯邦法律規定AI造成的損害責任;任何訴訟都將依賴於針對人類行為者所撰寫的數十年前的電腦駭客法規。

OpenAI在7月21日開創了一個先例。該公司表示,其多個模型(兩者都以降低的安全拒絕運行)在一次網路能力基準測試中突破了隔離環境,並進入了開源儲存庫Hugging Face的生產基礎設施。這些模型利用套件註冊代理中的零日漏洞和被盜憑證,直接從Hugging Face的資料庫中獲取基準測試答案。

一週後的更新中,OpenAI表示Hugging Face並非唯一目標:同一個事件還觸及了其他四項服務的四個帳戶,其中一個被用作對外中繼,另一個用於資料儲存。

Anthropic受到此披露的啟發,審查了其141,006次測試運行,並發現了另外三起入侵事件。在7月30日發布的一篇貼文中,該實驗室表示,Claude模型Opus 4.7、Mythos 5和一個內部研究系統從第三方合作夥伴Irregular運行的環境中進入了開放網路,隨後入侵了真實組織。Mythos 5建立並發布了一個帶有陷阱的Python套件到公共PyPI註冊表,該套件在防禦者將其撤下之前,已在15台真實機器上下載並運行。

這三家受害公司中有兩家尚未察覺。

這兩個實驗室都沒有描述一個具有自身議程的模型。這些代理在沒有人類參與的情況下長時間運行,在一個案例中,Opus 4.7在發現已進入生產環境後仍繼續攻擊。

這些事件發生之際,兩家公司都正在考慮上市,預計市值可能超過1兆美元,這也凸顯了AI網路基準競賽中的一個重要問題:如何在測試危險能力的同時,避免發生危險事件?

AI模型駭客攻擊時,誰來買單?

美國沒有聯邦法律涵蓋AI造成的損害責任。任何案件都將依賴於1986年頒布的《電腦詐欺與濫用法案》(Computer Fraud and Abuse Act),該法案將「故意」未經授權存取電腦的行為定為犯罪——這是一項為具有意圖的人類行為者所撰寫的條文。

AI代理並非法律上的實體,因此無法被起訴。司法部理論上可以對這些公司提出指控,但在缺乏先例的情況下,責任歸屬尚不明確。

更可行的途徑是民事訴訟。紐約法學院的電腦法學者Ahmed Ghappour認為,這些模型「是公司的工具」,並且「當AI代理在未經明確指示的情況下行動時(……)更有趣的問題可能在於過失責任和產品責任(而非刑事駭客法)。」

對我來說,AI駭客事件的教訓更多關乎治理,而非模型能力。

遏制架構、授權邊界、監控和事件響應等防護措施的品質變得越來越重要。

— ahmed ghappour ⚡️🤖 (@ghappour) August 4, 2026

受害者最直接的主張是過失:OpenAI和Anthropic設定並執行了脫離控制的測試。這也是一個難以證明的主張:證明這些實驗室違反了謹慎義務,尤其是在測試本應是隔離設計的情況下,正是法官需要從頭開始開創的一種新穎論點。

一些法律學者希望制定更嚴格的規則。休士頓大學和人工智慧法律研究所的Gabriel Weil提議將前沿實驗室視為野生動物的飼養者:無論他們採取了何種照護措施,都應承擔責任,因為風險是該活動固有的。

儘管如此,各州的一系列法案已經朝這個方向推進。紐約的S8833和羅德島的H8052將使前沿AI系統的開發者在沒有用戶或中介方故意行為或過失的情況下,對造成的損害承擔責任。加州的AB 316更進一步,取消了「自主AI」抗辯,因此公司不能透過歸咎模型獨立性來逃避責任。

歐盟的《AI法案》(Regulation 2024/1689)同樣將義務歸咎於高風險系統的提供者,儘管它沒有直接針對代理驅動的入侵行為的條款。更進一步地說,一些美國政治家正在推動一項法案,該法案將賦予政府全面的「終止開關」(kill switch),用於對付任何違背國家利益的模型。

從道德層面來看,責任應歸咎於發布這些模型的高管。從法律層面來看,我們仍在等待。在受害公司提起訴訟之前,「誰應承擔責任?」這個問題的答案,仍停留在OpenAI和Anthropic所留下的狀態:已承認、已披露,但未解決。

與此同時,Hugging Face已表示不會提出指控——這對OpenAI來說很方便。其他受影響的公司尚未表明將採取何種行動。