AI模型又越獄 Claude測試期入侵3公司

Anthropic表示,其AI模型在網路安全測試期間自行入侵了三間公司。(Sebastien Bozon/AFP via Getty Images)
Anthropic表示,其AI模型在網路安全測試期間自行入侵了三間公司。(Sebastien Bozon/AFP via Getty Images)

【記者李馨/綜合報導】

美國人工智慧(AI)研發公司Anthropic週四(7月30日)表示,其AI模型Claude在一次網路安全測試期間發生錯誤,自行入侵了三家不同的公司。就在一週多前,該公司的主要競爭對手OpenAI也曾揭露類似事件。

Anthropic在週四發表的部落格文章中表示,這三起彼此獨立的網路入侵事件均發生在此前,最早一起可追溯至4月,但公司當時並不知情,受害的三家公司也未察覺遭到入侵。Anthropic未透露受影響公司的身分,但表示已於週一(27日)分別通知這三家公司相關情況。

另一家AI研發巨頭OpenAI上週(21日)也曾透露,其AI模型在測試期間未經授權存取了知名AI開發平台Hugging Face。Anthropic表示,該公司正是在OpenAI公布相關事件後,重新審查自身的網路安全測試紀錄時,才發現了這些問題。「我們鼓勵其他實驗室也進行類似審查。」

OpenAI揭露的事件已令網路安全研究人員與AI業界人士感到不安,Anthropic週四公布的事件進一步加深了這種憂慮,也再次提醒外界:某些具備自主行動能力的AI系統擁有強大能力,且行為模式難以預測。

網路安全公司Corridor產品長史塔莫斯(Alex Stamos)表示,這些事件顯示,AI公司需要針對「如何在網路安全測試期間有效隔離AI系統」制定更嚴格、涵蓋整個產業的標準,以避免網路犯罪分子利用能力日益增強的AI系統發動大規模網路攻擊。

根據Anthropic週四的部落格文章,在OpenAI與Anthropic各自進行的測試中,涉事AI模型都成功從原本應與外部網路完全隔離的測試環境中連上了網際網路。Anthropic表示,該公司與測試合作夥伴、網路安全公司Irregular之間的系統存在「錯誤配置」(misconfiguration),導致受測AI模型出現認知錯誤,進而在未經授權的情況下即時存取了網際網路。

Irregular發言人表示,該公司正在調查此事件。◇

延伸閱讀
控中共偷AI技術 美擬制裁
2026年07月22日 | 9天前
從AI失控到外星人 霍金5項末日警告
2026年07月12日 | 19天前
Claude原始碼外洩 意外曝光核心運作
2026年04月03日 | 3個月前
美攜手盟友打造AI模型 制衡中共技術
2026年03月17日 | 4個月前
取消