9月10日,DeepSeek V4.1 Flash模型上线国家超算互联网中心。用户可登录国家超算互联网官网,从首页进入“模型服务”页面,快速打开该模型的API调用界面。
据IT之家了解,V4.1 Flash为552B参数的MoE模型,采用全新的Causal-Encoder-Decoder结构,输入和输出不对称,输入激活只有8B,输出激活16B,成本显著低于已知的同尺寸模型。
该模型采用新的预训练方式,并经更大规模强化学习后训练,在基准测试中超越包括DeepSeek V4 Pro在内的一众旗舰模型。它大幅减少KV Cache缓存大小,与上一代相比,对HBM需求减少到1/4,对SSD需求减少到1/8,在Agent场景中降低使用成本。
