研究人员提出了递归循环Transformer(RLT)架构,将因果编码器与递归解码器相结合。该设计通过在每个提示和响应令牌之间携带隐藏状态和滑动窗口注意力缓存,实现随序列增长而扩展的无界时间深度。
dealignai 团队于 2026 年 9 月 10 日发布了 DeepSeek-V4.1-Flash 的无审查版本(dealignai/DeepSeek-V4.1-Flash-UNCENSORED-FP8),通过权重级别消融技术移除了模型的安全防护机制,同时保留了核心能力。该模型包含 552B 参数,约占 510…
自建部署开源大模型的成本远超普通用户和企业的想象。以Kimi K3为例,仅显卡购置成本就需2560万元,加上液冷、机房等前期基础设施投入,打底需3000万元。DeepSeek V4-Pro需16张H200加速卡,硬件成本达376万元,而Qwen 3.8则需要64张B200,同样面临3000万元的初期投资。
Fermion Research 推出了 Neutrino-1 8B,一款参数量为 8.19B 的开源大语言模型 。该模型采用专有的三进制权重格式,将文件大小压缩至 3.88 GB ,可在数据中心 GPU、Mac 和桌面 CPU 上运行 。