8月26日晚,阿里通义千问团队正式发布Qwen3.8-Flash,并同步开源Qwen3.8-Flash-Next权重,后者被视为新一代Qwen4系列模型的雏形。
该模型为多模态MoE架构,主模型参数量125B,额外配备51B N-gram Embedding,每token激活6B参数,原生支持262,144 tokens上下文,可通过YaRN扩展至1M tokens。相比Qwen3.7-Plus,其训练成本约为前者的九分之一,编码和办公任务能力更强。
模型即将上线千问AI平台提供API服务,定价为每百万Tokens输入1元、输出3元。模型权重已于北京时间8月26日23:00在Hugging Face与ModelScope平台开源,同时发布FP8量化版本。
