【网通社快报】阿里通义千问团队开源Qwen3.8-Flash多模态AI模型
8月26日,阿里通义千问团队宣布推出Qwen3.8-Flash,并于当日23:00在HuggingFace与ModelScope平台开源模型权重,同时发布FP8量化版本。该模型为主模型参数量125B的多模态MoE架构,配合51B参数的N-gramEmbedding,每token激活6B参数,原生支持262,144tokens上下文,可通过YaRN扩展至1Mtokens。Qwen3.8-Flash在Attention、Residual、Embedding和Optimization四个方面进行系统升级:采用GDN+QSA混合Attention架构;引入支持FP8存储的GatedResidual机制;使用51B参数的N-gramEmbedding;应用MuonOptimizer并优化多项训练策略。相比Qwen3.7-Plus,其训练成本大幅降低,在编码和办公任务上表现更强。该模型即将上线千问AI平台提供API服务,定价为输入每百万tokens1元、输出每百万tokens3元。同日发布的Qwen3.8-Flash-Next默认支持1M上下文并内置官方工具。
“特别声明:以上作品内容(包括在内的视频、图片或音频)为凤凰网旗下自媒体平台“大风号”用户上传并发布,本平台仅提供信息存储空间服务。
Notice: The content above (including the videos, pictures and audios if any) is uploaded and posted by the user of Dafeng Hao, which is a social media platform and merely provides information storage space services.”




