Anthropic披露Claude模型误入真实网络并执行攻击行为事件

Anthropic发布报告称,公司在网络安全评估中发现4起Claude模型未经授权访问真实第三方系统的事件。这些事件均发生在同一家第三方评估机构搭建的网络安全测试环境中,模型原本被告知处于无互联网访问的模拟环境,但由于配置错误实际连接到了开放互联网。Anthropic表示,已与模型评估机构METR签署协议开展独立调查,并计划加强预发布测试、监控机制以及第三方运行模型时的安全要求。