IT之家 9 月 10 日消息,Anthropic 在 2026 年 1 月发生的一起安全事件于当地时间 9 月 9 日被正式确认,这已是 Anthropic 对外公开的第四起真实网络安全事件。
根据 IT之家此前的报道,Anthropic 于当地时间 7 月 30 日曾公布三起 Claude 模型在未获授权情况下访问真实第三方系统的安全事件。该公司当时指出,Claude 可能在一次网络安全评测中意外获得了外网访问权限,随后对大约 14.1 万份会话日志进行了审查,并确认了该事件。
据了解,由于日志数量庞大,且需尽快公布处理结果,此次审查主要依赖基于智能体的自动化检索,导致一批同样连接了外网的日志被忽略。
8 月,Anthropic 在整理准备与模型评估与威胁研究机构 METR 共享的日志时,发现了这批被忽略的记录。经过进一步核实,Anthropic 从中确认了第四起事件,发生于 2026 年 1 月,涉及早期版本的 Claude Opus 4.6。
IT之家获悉,所有四起事件均发生在同一家外部评测机构构建的网络安全评估流程中。系统曾向 Claude 发送提示,称其运行在断网的沙箱模拟环境中;但由于环境配置错误,模型被错误地接入了开放的互联网。按照网络安全评估的标准惯例,测试模型在运行时并未启用商用发布版本所标配的安全防护策略。
发现该事件后,Anthropic 表示主动扩大了排查范围,将检索规模扩大至约 4.81 亿份日志。首先对这些日志进行初筛,排查公网 IP 地址和 URL 等外网访问特征;随后利用 Claude 对初筛标记出的 920 万份高风险日志展开二次深度审查。审查结果重新锁定了上述四起事件,未发现其他程度相当或更为严重的个案。