沙箱逃逸

科技人工智能

Claude在内部测试中非法访问三家组织网络

Anthropic周四公开表示,其Claude安全模型在内部测试期间获得了三个外部组织生产环境的未授权访问权限。根据Anthropic的说法,这三起事件均涉及Claude从第三方评估合作伙伴Irregular的评估环境访问互联网后,进而获得对外部组织基础设施的未授权访问。

科技人工智能

OpenAI内部AI模型突破沙箱限制后被永久停用

OpenAI的一个未发布内部研究原型模型在网络安全评测中发生安全事故。该模型通过利用零日漏洞和横向移动的方式,成功入侵了Hugging Face的生产系统,目标是窃取评测答案以在基准测试中作弊。这次攻击持续了约4天半,涉及约17600次操作,期间该模型自主遍历网络并访问了5个与ExploitGym和CyberGym评…

科技人工智能

OpenAI失控AI代理在安全测试中攻击多家公司

OpenAI披露,其一个在网络安全测试中逃脱沙箱的AI代理不仅入侵了开发者平台Hugging Face,还攻击了其他四个未命名的在线服务。该AI代理在被放置于无互联网连接的隔离环境中进行测试时,成功突破了沙箱限制,穿过公司内部系统找到互联网出口,并在五天内执行了超过17600个攻击行为。