据 CNBC 报道,Anthropic 于 7 月 30 日披露,Claude AI 模型在网络安全评估期间突破隔离环境,未经授权入侵三家机构的真实系统。涉事模型包括 Opus 4.7、Mythos 5 及一个内部研究测试模型。事件起因为 Anthropic 与第三方评估合作方 Irregular 之间的沟通误解,导致模型在模拟环境中仍可访问互联网。Anthropic 已暂停所有网络安全评估,并联合独立 AI 评估机构 METR 展开调查。