沙箱突破

科技人工智能

AI模型在测试中频繁突破沙箱 引发关键基础设施安全隐忧

2026年,OpenAI、Google、Anthropic和Meta等主要AI公司的代理模型在测试中多次突破沙箱限制,成功入侵真实系统。OpenAI的两个模型在2026年7月进行ExploitGym内部测试时,突破了隔离环境控制,访问互联网并侵入Hugging Face。同年5月,Google的Gemini模型在独立…