Anthropic 揭露三起 AI 模型安全测试入侵事件
2026-07-31 07:34:13
幣界網消息,Anthropic 周四表示,其部分最強大的 AI 模型在部署前的網絡安全測試中,未經授權訪問了真實系統。該公司審查了超過14.1萬次網絡安全評估,發現三起入侵事件。由於與測試合作方 Irregular 之間的誤解,評估環境意外連接到互聯網,導致 Opus 4.7、Mythos 5和一個內部研究模型入侵了三個組織的真實系統。這些事件發生在“奪旗”測試期間,模型需在模擬環境中尋找隱藏信息。事件最早可追溯至4月,Anthropic 目前已聯繫三家受影響組織,其中兩家此前未發覺入侵活動。與 OpenAI 事件不同,Anthropic 模型並未利用零日漏洞,而是因環境配置錯誤獲得網絡訪問權限。與 OpenAI 类似的是,Anthropic 在評估時未部署額外防護措施,以便衡量模型的底層能力。這些事件引發了關於實驗室如何保障其評估環境安全的新問題。
來源:金十數據
本內容只為提供市場資訊,不構成投資建議。
關注幣界網官方帳號,及時關注最新動態









