资讯中心

阿里通义千问发布Qwen3.8-Flash:训练开销仅为前代1/9,国内Flash之战正式开打

📅 2026/8/27 23:40:59
阿里通义千问发布Qwen3.8-Flash:训练开销仅为前代1/9,国内Flash之战正式开打
阿里通义千问团队正式发布Qwen3.8-Flash该模型参数亮眼、架构有四大变化还提前开放Qwen3.8-Flash-Next开源权重与智谱同日发布新品国内Flash之战打响。参数亮眼性能提升Qwen3.8-Flash拥有125B总参数 51B N-gram Embedding每token只激活6B参数原生支持262K上下文可扩展到1M。相比Qwen3.7-Plus训练开销仅为其1/9在编码和办公任务上能力更强。架构四大变化Attention层采用Gated DeltaNet和Qwen Sparse Attention混合架构加速显著Residual连接改成Gated Residual降低访存开销Embedding层引入51B的N-gram Embedding不增加每token计算量优化器换成Muon明确参数分工。提前开放开源权重通义提前开放Qwen3.8-Flash-Next的开源权重这是Qwen4系列模型的雏形等社区检验完再构建完整模型家族权重可在HuggingFace和ModelScope下载。上线平台提供API服务Qwen3.8-Flash现已上线千问AI平台对外提供API服务每百万Tokens输入1元输出3元。国内Flash之战打响阿里通义千问和智谱同一天晚上先后发布Qwen3.8-Flash和GLM-5.3-Flash都走能力不降级、价格降级路线且都选国产芯片做推理部署验证。编辑观点Qwen3.8-Flash的发布展现了阿里在大模型领域的技术实力与智谱的竞争将推动国内大模型市场发展未来或有更多创新成果涌现。