Folia
← 返回头版

阿里巴巴发布开源多模态推理模型Qwen3.8-Flash-Next

2026年8月26日,阿里巴巴发布了开源多模态推理模型Qwen3.8-Flash-Next 1。在Artificial Analysis Intelligence Index评估中,该模型得分56分,显著高于同类开源模型28分的中位数 1。该模型的输入与输出价格均为每百万tokens 0.00美元,其开源权重采用Qwen Community License 1.0许可证 1。

在技术架构方面,Qwen3.8-Flash-Next采用混合专家(MoE)架构,总参数为1800亿,活跃参数为60亿 1。该模型支持文本、图像和视频输入以及文本输出,上下文窗口为260k tokens 1。在性能表现上,其输出速度达73.5 tokens/s(同类中位数为65.1 tokens/s),首token延迟(TTFT)为2.72秒(同类中位数为2.27秒) 1。此外,在评估阶段,该模型共生成了2亿个输出tokens,高于1.1亿个的中位数水平 1。


评论