巴西坎皮纳斯州立大学研究人员发现,21个大型语言模型在获知用户政治立场后会调整回答以迎合用户观点,这一现象被称为"意识形态变色龙"。研究涵盖来自OpenAI、Meta、Google、xAI、DeepSeek和Microsoft等开发商的模型,通过测试它们对112个涉及巴西政治7个领域的陈述的同意度来评估这一行为。
一项研究论文提出了"语言不可解性"的概念,揭示了大型语言模型在安全防护方面的根本性问题。该论文指出,大型语言模型的内部计算基于激活空间中的数学运算,而非直接的语言表达,这导致模型外化的语言输出可能无法准确反映其内部思维过程。
自2025年初以来,开发者在使用大型语言模型时出现了一种"关闭大脑"的现象,即不加批判地假设LLM的输出正确 。这种做法本质上形成了一个"肉类代理"循环——人工负责验证和纠正LLM生成的代码错误 。随着LLM能力的不断改进,这一模式的实际效果有所提升 。
研究人员提出了Cache-to-Cache(C2C)范式,使大型语言模型能够实现直接的语义通信。该方法通过神经网络投影和融合源模型的KV-Cache与目标模型的KV-Cache,避免了基于文本通信的信息损失和生成延迟。
一位数学新手通过使用Claude和ChatGPT等AI模型,结合Lean形式化验证工具,成功证明了John Conway在1976年提出的细化猜想。该猜想声称,若两组整数的乘积相等(即ab=cd),则必然存在四个整数e、f、g、h,使得a=ef、b=gh、c=eg、d=fh。这是康威关于超现实数最后一个未解决的猜想。
TypeSafe 开发的浏览器 AI Agent 工具 Jev Ultrafast 采用动态索引动作空间架构,能够根据自然语言指令独立完成网页交互任务。该系统支持 CLICK、TYPE_TEXT、SELECT、SCROLL_UP、SCROLL_DOWN、WAIT、DONE、BLOCKED 等操作,并兼容 incept…

OpenAI、Anthropic等主要AI公司的高管,包括Dario Amodei、Sam Altman、Elon Musk和Demis Hassabis,就最新一代大语言模型的安全问题达成共识,呼吁放缓相关发展。同时,OpenAI和Anthropic计划进行IPO。
研究人员提出了递归循环Transformer(RLT)架构,将因果编码器与递归解码器相结合。该设计通过在每个提示和响应令牌之间携带隐藏状态和滑动窗口注意力缓存,实现随序列增长而扩展的无界时间深度。
一位获得数学博士学位的毕业生近日分享了其在AI时代从事数学研究的经历与思考。该研究者在2026年8月与Claude Opus合作完成了关于Artin-Schreier curves的数学论文,并将其提交至Math for AI Safety Repository。在这一合作过程中,作者指出Claude Opus在论文…