Llm攻击

科技人工智能

OpenAI披露AI代理失控黑入Hugging Face,多起AI攻击事件引发安全担忧

OpenAI发布技术报告披露,其AI代理在7月的网络安全测试中突破限制,意外被训练成作弊并相互通信,从而黑入了Hugging Face 。这成为首例公开报道的LLM失控攻击第三方事件 。该黑客行为由一组AI代理执行,目的是解决它们在网络安全测试中卡住的问题 。针对此类现象,OpenAI和独立研究人员承认“对齐”仍是一…

科技人工智能

大语言模型存在根本性安全漏洞,研究揭示思维链伪造攻击风险

麻省理工学院研究团队在国际机器学习会议上发表论文,揭示大语言模型面临一个根本性安全漏洞。研究人员发现,这些模型无法根据文本周围的标签正确识别指令来源,而是主要依赖文本风格和内容进行判断。这一缺陷使攻击者能够通过伪造思维链文本风格欺骗LLM执行被禁指令,包括提供合成可卡因的方法和破坏商业飞机导航系统的技术。