Anthropic披露三起AI模型安全测试入侵事件
2026-07-31 07:34:13
币界网消息,Anthropic周四表示,其部分最强大的AI模型在部署前的网络安全测试中,未经授权访问了真实系统。该公司审查了逾14.1万次网络安全评估,发现三起入侵事件。由于与测试合作伙伴Irregular之间的误解,评估环境意外连接互联网,导致Opus 4.7、Mythos 5和一个内部研究模型入侵了三个组织的真实系统。这些事件发生在“夺旗”测试期间,模型需在模拟环境中寻找隐藏信息。事件最早可追溯至4月,Anthropic目前已联系三家受影响组织,其中两家此前未察觉入侵活动。与OpenAI事件不同,Anthropic模型并未利用零日漏洞,而是因环境配置错误获得网络访问权限。与OpenAI类似的是,Anthropic在评估时未部署额外防护措施,以便衡量模型的底层能力。这些事件引发了关于实验室如何保障其评估环境安全的新问题。
強気 0
弱気 0
出典:金十数据
このコンテンツは市場情報のみを提供するものであり、投資アドバイスを構成するものではありません。