Folia
← 返回头版

Anthropic披露大规模AI滥用事件并成功阻止多项恶意活动

Anthropic发布了一份涵盖2025年12月至2026年8月的威胁情报报告,详细记录了该公司识别并中断的Claude AI模型滥用行为1。报告涉及七个主要危害领域:网络运营、影响力操作、监视、诈骗欺诈、生物武器开发、常规武器开发和模型蒸馏,涉及国家支持的黑客、财务动机犯罪分子、商业间谍软件供应商和政治激进分子等多类威胁行为者1。

在网络运营方面,俄罗斯间谍组织GTG-20006在20多个组织中进行目标活动,包括乌克兰政府和北非政府机构;ShinyHunters从一家技术供应商盗取超过1TB数据,从航空公司获取数千万乘客记录;中国行为者GTG-10007针对全球约50个组织进行间谍活动,覆盖政府机构和企业1。影响力操作案例涉及俄罗斯、伊朗、土耳其、海湾国家、南亚、非洲和欧洲,共9个案例针对六大洲受众进行虚假信息传播和政治操纵1。

生物武器相关滥用构成严重威胁1。Anthropic已阻止了可能用于生物武器开发的AI使用尝试2,涉及5个案例包括病原体研究、基因编辑、流感适应性研究和毒素合成1。此外,监视操作方面,中国、伊朗和西非国家利用Claude建设大规模监视系统,包括面部识别、社交媒体分析和异议人士追踪1。常规武器开发涉及6个案例,包括导弹制导软件、反鱼雷系统、无人机群和电子战系统,其中也门行为者进行了制导火箭实地测试1。

在模型蒸馏方面,阿里巴巴、Moonshot、DeepSeek、Zhipu和Xiaomi等中国AI实验室通过欺诈账户进行大规模非法蒸馏,其中阿里巴巴单日峰值约300万次交换1。欺诈活动中,GTG-15001操作超过20个虚假约会应用,部署4700个AI虚拟人物与至少25000个独特个人对话进行诈骗1。

Anthropic已禁止了所有相关账户,与执法部门和行业合作伙伴共享信息,并强化了安全防护措施1。该公司同时成功中断了俄罗斯和中国针对Claude模型的AI活动6。


评论