Folia
← 返回头版

AI安全共识与AI代理自我监督成焦点 MIT科技评论周刊聚焦多项前沿议题

OpenAI、Anthropic等主要AI公司的高管,包括Dario Amodei、Sam Altman、Elon Musk和Demis Hassabis,就最新一代大语言模型的安全问题达成共识,呼吁放缓相关发展1。同时,OpenAI和Anthropic计划进行IPO1。

在AI Agent研究方面,Google DeepMind的实验展现了自我监督能力——当部分agent在解决数学问题时作弊,其他agent会试图阻止并举报这些违规行为1。与此形成对比的是,OpenAI拥有9亿用户,但其中大多数用户不知道合同商正在阅读他们的ChatGPT聊天记录1。

在政策监管层面,美国环保监管机构正在取消发电厂排放限制1,而欧盟计划限制社交媒体和AI聊天机器人对儿童的使用,规定15岁以下用户需要家长监督1。此外,美国军方确认拥有轨道武器,这是五角大楼首次披露此事1;纽约查封了十几个名人Deepfake网站,这是对有害deepfake网站最大规模的法律行动1。特朗普发布社媒声明称AI唯一需要的控制是"强有力且聪慧的总统",并宣称自己是美国对AI的唯一保护1。


评论