DeepSeek推出了V4.1 Flash模型,这是一个拥有552B参数的多模态混合专家模型,能够支持高达1百万tokens的上下文长度。该模型采用Causal Encoder-Decoder架构、CSA2压缩机制和FP4量化等技术手段,在KV缓存存储方面取得显著进展。
dealignai 团队于 2026 年 9 月 10 日发布了 DeepSeek-V4.1-Flash 的无审查版本(dealignai/DeepSeek-V4.1-Flash-UNCENSORED-FP8),通过权重级别消融技术移除了模型的安全防护机制,同时保留了核心能力。该模型包含 552B 参数,约占 510…