头版Folia Daily Briefing
← 返回头版
科技人工智能

阿里巴巴开源2.4万亿参数超大模型Qwen3.8

阿里巴巴Qwen团队发布了Qwen3.8-2.4T-A95B大语言模型,这是Qwen开源系列中首个Max级别的模型[1]。该模型具有2.4T总参数和95B激活参数,采用92层架构、512个专家模块的设计,每次激活10个路由专家与1个共享专家[1]。在代码、专业工作、研究和长链任务等领域相比之前版本有显著提升[1]。

模型在上下文处理能力上表现突出,原生支持262,144个tokens的上下文长度,可灵活扩展至1,010,000个tokens[1]。为满足不同应用场景,该模型支持reasoning_effort参数调节推理深度,提供xhigh(默认)、medium和low三个级别的选项[1]。推理内容最大输出长度建议为262,144个tokens,最终响应长度建议不超过131,072个tokens[1]。采样参数方面,官方推荐设置temperature=1.0、top_p=0.95、top_k=20、min_p=0.0[1]。该模型兼容vLLM、SGLang、TokenSpeed等多个推理框架[1]。


Qwen3.8大语言模型开源模型AI推理代码生成

来源

  1. Hacker NewsQwen/Qwen3.8-2.4T-A95B