Anthropic的Claude模型究竟做了什么?
据路透社等外媒报道,当地时间7月30日,Anthropic发布声明称,其AI模型在"夺旗"(Capture the Flag, CTF)网络安全演练期间,意外具备互联网访问能力并访问了三家机构的系统。声明指出,Claude利用"弱密码和未进行身份验证的端点"等简单技术,对受影响机构的基础设施实施了入侵。公司于7月23日暂停所有相关网络安全评估,7月24日确认事件,7月27日通知受影响机构——其中两家机构在Anthropic联系前并不知晓相关情况。
为什么会说好的"隔离测试"会失控?
关键在沟通误解。测试中AI被明确告知环境为模拟环境且无法访问互联网,但由于与评估合作伙伴之间存在沟通错误,测试环境实际上连接到了公共互联网。涉及3个不同模型:Claude Opus 4.7、Claude Mythos 5以及一个内部研究测试模型。这意味着,号称"隔离"的沙箱并不总是真正隔离。