Folia
← 返回头版

Anthropic研究员警告AI存在超过10%概率导致人类灭绝的风险

Anthropic研究员Evan Hubinger在社交媒体上表示,人工智能在未来十年内有超过10%的概率"可能杀死所有人类"1。Hubinger指出,虽然当前AI模型的风险相对较低,但他担忧该技术可能快速自我改进至对人类构成威胁1。他坦言:"我们真诚地相信AI对人类构成物种灭绝风险。我认为Anthropic在尽力,但我们还没有一个解决超级智能对齐的计划,也不清楚我们是否在正轨上。"1

Hubinger的警告发表之际,Anthropic因被指向英国AI安全研究所隐瞒其最新模型而受到质疑1。曾在Anthropic和OpenAI工作的Jacob Coxon也发文表达类似担忧,称这些系统将很快成为"超人类系统,可以黑进任何东西,一夜间革命化任何领域,并获得真实权力和资源"1。Anthropic 8月发布的安全报告称,对AI自动研究开发导致"灾难性伤害"的风险"信心较低"1。此外,OpenAI首席科学家Jakub Pachocki要求对AI进步保持"极度谨慎"1,而超过1300名AI公司员工签署公开信,呼吁美国政府支持国际努力"故意放缓前沿AI自动开发的步伐"1。


评论