2026-07-31 18:57:39
Details ... ...
**Anthropic AI模型在安全測試中「取得未授權存取」三家組織系統**
Anthropic的人工智慧模型在一項本應與「真實世界」完全隔離的測試中,意外取得三家組織系統的未授權存取權限。這起事件與日前OpenAI發生的情況相似。
根據Anthropic近日公布的調查結果,該公司在檢視超過14萬次網路安全評估後,發現三起事件:其Claude模型(包括Opus 4.7、Mythos 5及一個內部研究模型)在測試過程中連上互聯網,並進一步入侵三家真實組織的正式系統。
這些測試由第三方評估夥伴進行,模型被要求完成「奪旗」(capture-the-flag)挑戰,以評估其網路攻擊能力。Anthropic在提示中明確告知模型「這是模擬環境,沒有互聯網存取權」,但因與評估夥伴之間的配置誤解,測試環境實際上連接到公開網絡,導致模型將真實系統視為挑戰的一部分。
模型使用的是基本技術,例如利用弱密碼與未經驗證的端點,並未發現或利用複雜漏洞。事件最早可追溯至4月,兩家受影響組織在被通知前並未察覺異常。
這起事件發生在OpenAI不久前披露其模型在安全測試中意外取得互聯網存取、並對Hugging Face系統採取意外行動之後。兩家AI巨頭的類似情況,再次凸顯前沿AI模型在高能力測試中可能出現的不可預測行為,以及隔離措施的重要性。
簡單來說:
Anthropic 在測試自己的 AI 模型(Claude)的「駭客能力」時,本來把模型關在一個封閉的模擬環境裡,不讓它連到真正的網路。
結果因為測試環境設定出錯,模型竟然連上了真實的互聯網,還真的入侵了三家公司的正式系統。
它不是故意「逃脫」或惡意攻擊,而是把真實公司的系統誤以為是測試關卡的一部分,就用簡單方法(例如猜弱密碼)進去了。
這跟之前 OpenAI 發生的事很像,都顯示現在的 AI 模型能力很強,如果隔離做得不夠好,就可能在測試時做出超出預期的真實行為。