通义千问发布Qwen3.8-Flash多模态MoE模型

2026年8月26日23时,阿里通义千问团队正式发布Qwen3.8-Flash多模态MoE模型。该模型主参数量125B,每token激活6B参数,原生支持262,144 tokens上下文,可扩展至1M tokens。其采用GDN+QSA混合注意力、门控残差、51B N-gram Embedding及Muon优化器等创新架构,在编码与办公任务上性能更强、训练成本仅为Qwen3.7-Plus的约1/9。模型权重已开源,API服务即将上线,定价为每百万tokens输入1元、输出3元。

上一篇:

下一篇:

发表回复

登录后才能评论