2026-08-27 · AI 资讯
通义千问发布Qwen3.8-Flash-Next,开启Qwen4架构预览
阿里通义千问团队近日开源了Qwen3.8-Flash-Next模型,作为Qwen4架构的先行版本,该模型展现了极高的计算效率。它采用了1250亿总参数规模的混合专家(MoE)设计,但每个token仅激活60亿参数,在大幅降低训练成本的同时,实现了显著的性能跃升。
技术层面,该模型引入了GDN与QSA混合注意力机制,并将上下文窗口通过YaRN技术扩展至1M。此外,通过异步预取技术将510亿参数的N-gram嵌入驻留于系统内存,在不增加额外计算开销的前提下大幅提升了模型容量。
测试显示,凭借6B的激活参数,Qwen3.8-Flash-Next在代码编写和办公任务中表现优异,能力表现已超越Claude Opus 4.6 Max等旗舰模型。SGLang已在发布首日同步支持该模型,极大地方便了开发者在本地或集群环境进行高效部署。
