【网通社快报】阿里通义千问团队开源Qwen3.8-Flash多模态AI模型

【网通社快报】阿里通义千问团队开源Qwen3.8-Flash多模态AI模型

8月26日,阿里通义千问团队宣布推出Qwen3.8-Flash,并于当日23:00在HuggingFace与ModelScope平台开源模型权重,同时发布FP8量化版本。该模型为主模型参数量125B的多模态MoE架构,配合51B参数的N-gramEmbedding,每token激活6B参数,原生支持262,144tokens上下文,可通过YaRN扩展至1Mtokens。Qwen3.8-Flash在Attention、Residual、Embedding和Optimization四个方面进行系统升级:采用GDN+QSA混合Attention架构;引入支持FP8存储的GatedResidual机制;使用51B参数的N-gramEmbedding;应用MuonOptimizer并优化多项训练策略。相比Qwen3.7-Plus,其训练成本大幅降低,在编码和办公任务上表现更强。该模型即将上线千问AI平台提供API服务,定价为输入每百万tokens1元、输出每百万tokens3元。同日发布的Qwen3.8-Flash-Next默认支持1M上下文并内置官方工具。