9月10日,DeepSeek正式发布DeepSeekV4.1Flash模型。
DeepSeek据CNMO科技了解,DeepSeekV4.1Flash为552B参数的MoE模型,采用全新的Causal-Encoder-Decoder结构,输入和输出不对称,输入激活只有8B,输出激活16B,成本显著低于已知的同尺寸模型。同时,V4.1Flash还采用了新的预训练方式、经过了更大规模的强化学习后训练,在基准测试中,成功超越了包括DeepSeekV4Pro在内的一众旗舰模型的智能水平。此外,DeepSeekV4.1Flash已同步上线DeepSeekAPI,原生支持多模态,将模型名称更改为deepseek-flash即可调用最新的V4.1Flash模型。旧版本模型V4Flash与V4FlashVisionExp现已下线,出于兼容考虑,模型名deepseek-v4-flash、deepseek-v4-flash-vision-exp将被暂时路由到V4.1Flash。得益于模型架构的创新,DeepSeekV4.1Flash能够以更低的成本服务更多的用户,因此DeepSeek相应下调了V4.1Flash的定价。
