一项研究论文提出了"语言不可解性"的概念,揭示了大型语言模型在安全防护方面的根本性问题。该论文指出,大型语言模型的内部计算基于激活空间中的数学运算,而非直接的语言表达,这导致模型外化的语言输出可能无法准确反映其内部思维过程。
有评论人士指出,当前AI行业正在重复互联网泡沫时期的预测失误。这位分析者通过对比历史发展轨迹认为,虽然广泛应用AI代理是趋势,但真正采用代码型AI代理的用户不足1%。他强调,关键障碍在于构建安全保障充分的沙箱环境,使AI代理的失败率降至0%。
作者使用 GPT 5.6-Cyber 对运行在 Debian Linux 12 和 AMD Zen3 宿主机上的 QEMU/KVM 虚拟机进行了逃逸测试 。测试结果显示,该 AI Agent 在约 12 小时的时间跨度内持续自主运行,通过回溯失败路径并构建可复用的漏洞利用,成功实现了三次虚拟机逃逸 。