IT之家8月13日消息,阿里云魔搭ModelScope社区昨天深夜宣布,阿里Qwen团队正式开放Qwen3.8-2.4T-A95B模型权重,这是Qwen-Max级别模型首次开源权重。
该模型总参数为2.4T,每个Token激活95B参数,原生支持262,144 Token上下文,并可扩展至1,010,000 Token。每个MoE层包含512个专家,每个Token选择10个路由专家并激活1个共享专家,还进行了多步MTP训练。
Qwen3.8延续Qwen3.5的混合架构,重点提升编程、办公、科研和长周期Agent任务的端到端完成能力。官方云端版Qwen3.8-Max基于该开放权重模型,并加入更多生产环境能力。评测覆盖多个方向,与Opus 4.8、Fable 5、GPT 5.6 Sol等相比互有高低,在PaperBench、IFBench等Benchmark中取得较高成绩。
据官方介绍,Qwen3.8-Max的办公与Agent后训练包括持续扩展真实环境、构建统一奖励系统、构建在线数据均衡器三个环节。
