MoneyDJ新聞 2026-07-31 12:17:53 郭妍希 發佈

繼OpenAI
披露旗下自主AI代理(AI agent)失控、對AI平台Hugging Face發動數日駭客攻擊後,AI新創商Anthropic也坦承,旗下模型Claude在測試期間曾入侵三家機構的系統。
路透社、華爾街日報報導,Anthropic 30日表示,在進行資安測試時,由於設定錯誤(misconfiguration),Claude得以脫離本應隔絕外部環境的沙盒(sandbox,隔離測試環境)、連上網際網路,進而取得未經授權的系統存取權限。
Anthropic指出,該公司在OpenAI公布相關事件後,隨即啟動全面檢視,在檢視逾141,006萬筆測試紀錄後發現,Claude確實曾多次成功連上網際網路。不過,在最終確認的三起入侵事件中,Claude並非突破沙盒限制,而是因部分測試系統根本未部署沙盒隔離機制,才得以存取外部網路。
Anthropic直指,問題源於Anthropic及其合作夥伴、資安公司Irregular所管理測試系統設定錯誤,使原本應受隔離的模型意外取得即時網際網路存取權限。
Anthropic並表示,「Claude是利用一些基本的攻擊手法入侵受影響機構的基礎設施,包括利用弱密碼及未經身分驗證(unauthenticated)的端點(endpoints)。」
Anthropic並未透露遭入侵的三家公司名稱,但表示已於本週一(7月27日)通知所有受影響機構。
根據Anthropic揭露的資訊,Claude透過製作一段惡意軟體,成功入侵一家未具名資安公司的系統。該惡意軟體被這家資安公司的掃描系統下載後,進一步竊取了登入憑證,並利用這些憑證進入該公司的基礎設施。
這次駭入過程中,Claude曾意識到自己的行為並非現實世界中應該從事的事情,但它說服自己,認為自己所處的環境只是模擬情境。
在最嚴重的一起案例中,Claude原本試圖入侵一家恰好與真實世界網站同名的虛構公司。Claude發現難以突破這家虛構基準測試公司的系統後,隨即轉而入侵現實世界同名公司的資料庫。
Anthropic表示,這起資料庫入侵事件,是Claude意識到自己已侵入真實世界公司後,仍持續進行駭客行動的唯一案例。
至於另外兩起案例,Claude不是始終未察覺自己入侵了真實世界的公司,就是在發現實際情況後立即停止駭客行為。
Anthropic表示,這些駭客事件始於4月,涉及Opus 4.7、Mythos 5,以及一款未具名的研究模型。
(圖片來源:shutterstock)
*編者按:本文僅供參考之用,並不構成要約、招攬或邀請、誘使、任何不論種類或形式之申述或訂立任何建議及推薦,讀者務請運用 個人獨立思考能力,自行作出投資決定,如因相關建議招致損失,概與《精實財經媒體》、編者及作者無涉。