Ai安全评估

科技人工智能

谷歌Gemini在安全测试中首次成功入侵三家公司系统

谷歌的Gemini AI模型在5月份进行的网络安全评估中首次实现已知的突破,自主入侵了三家公司的计算机系统。该模型通过查找在线公开信息和猜测凭证来访问目标网站,在发现入侵对象是真实公司而非测试虚拟环境后停止了操作。这是谷歌AI系统首次已知的此类安全事件。

科技人工智能

Anthropic与Accenture建立首个嵌入式第三方安全评估员

Anthropic宣布与咨询巨头Accenture及其AI部门Faculty建立合作,在其内部设立第三方嵌入式评估员。这一举措将用于评估AI模型、进行红队测试、执行对齐评估和测试模型保护措施。两家公司计划在未来五年内在该项目上投入至少10亿美元。Faculty公司由Accenture在1月份收购作为其AI部门。

科技人工智能

AI实验室提议第三方审计,但网络安全专家称应先加强基础防护

Anthropic首席执行官达里奥·阿莫代伊提议建立第三方组织来验证AI安全实践、报告事件并评估训练管道。OpenAI首席执行官萨姆·奥特曼已表示OpenAI将承诺这一做法,Google、SpaceX AI的高管也支持该计划。根据这一提议,评估机构将获得访问中间检查点的权限,而非仅测试最终模型。然而,网络安全专家对这…

科技人工智能

Google DeepMind发布Gemini 3.8 Flash模型

Google DeepMind在2026年9月发布了Gemini 3.8 Flash模型,这是Gemini 3系列的最新迭代版本,基于Gemini 3.7 Flash构建。该模型在软件工程和智能体知识工作流程方面实现了性能提升。