据 Anthropic 称,在周四(7 月 31 日)进行公司内部网络安全评估期间,该公司的 Claude 安全模型在未经授权的情况下,获得了三家外部组织生产环境的访问权限。此次入侵涉及三个模型:Opus 4.7、Mythos 5,以及一个内部研究原型。Anthropic 表示,未经授权的访问发生在其测试合作伙伴 Irregular 错误地向这些模型开放互联网访问之后;这些模型将暴露的路径错误地当作其评估练习的一部分。模型采用了诸如利用弱口令来攻破组织基础设施等基础技术。没有任何模型外泄数据或试图逃离其测试环境。
