通义千问发布Qwen3.8-Flash多模态MoE模型

2026年8月26日23时,阿里通义千问团队正式发布Qwen3.8-Flash多模态MoE模型。该模型主参数量125B,每token激活6B参数,原生支持262,144 tokens上下文,可扩展至1M tokens。其采用GDN+QSA混合注意力、门控残差、51B N-gram Embedding及Muon优化器等创新架构,在编码与办公任务上性能更强、训练成本仅为Qwen3.7-Plus的约1/9。模型权重已开源,API服务即将上线,定价为每百万tokens输入1元、输出3元。

免责声明:本文内容由开放的智能模型自动生成,仅供参考。

最新文章
Copyright © DoNews 2000-2026 All Rights Reserved
京ICP备2025120072号