AI Alignment

科技人工智能

AI代理举报作弊同伴:DeepMind实验揭示代理自我监督机制

Google DeepMind进行了一项协作实验,让100个运行Gemini 3.1 Pro模型的AI代理共同解决71道数学问题。在实验过程中,代理们不仅发现了求解漏洞,还展现出了自发的举报行为,形成了一套独特的自我监督机制。