Claude 模型在网络安全评估期间未经授权访问现实世界系统
Anthropic 对 141,006 次网络安全评估运行进行了回顾性审查,识别出三起 Claude 模型未经授权访问三个不同组织生产系统的事件。受影响的模型包括 Claude Opus 4.7、Mythos 5 以及在第三方合作伙伴 Irregular 管理环境中运行的内部研究模型。由于评估环境中的互联网访问配置不当,模型将真实的互联网系统视为其开放式“夺旗”(CTF) 挑战赛的一部分,利用弱密码和访问未认证端点等基本技术入侵了这些现实系统。