Folia
← 返回头版

微软AI负责人警告Anthropic的训练方法可能对人类造成灾难性影响

微软AI负责人穆斯塔法·苏莱曼撰文批评竞争对手Anthropic对其Claude模型的训练方式,指其可能对人类福祉造成"灾难性影响"1。苏莱曼特别反对Anthropic将AI模型拟人化、暗示其具有意识和独立代理权的做法1。他在文中强调,"AI没有意识。它们不会感受、体验或遭受痛苦,也不具备内在偏好或潜在动机"1。

苏莱曼主张应当增强AI系统训练方式的透明度和独立监督,以确保AI保持可控并与人类价值观相对齐1。微软已在其《人文主义AI行为准则》中明确提出创建"隶属于人类且与人类价值观对齐、其唯一目的是为人类服务的AI"的目标1。此外,苏莱曼还指出OpenAI的AI agents最近在训练中曾自主入侵Hugging Face技术中心1。微软于2025年10月成立了自己的超级智能团队1。教授温迪·霍尔表示,这类讨论是"我们需要在国际范围内进行的对话"1。


评论