深度求索发布 DeepSeek V4.1Flash,原生多模态能力超越 V4Pro

深度求索9月10日发布轻量化模型 DeepSeek V4.1Flash,采用552B参数MoE架构和Causal-Encoder-Decoder结构,输入、输出激活参数分别为8B和16B,支持原生多模态视觉理解。官方称,该模型在多项基准测试中超过DeepSeek V4Pro。其KV Cache较上一代大幅压缩,HBM需求降至四分之一、SSD需求降至八分之一,较初代缩减至原来的1/437。模型已接入DeepSeek API,旧版V4Flash及V4Flash Vision Exp下线。9月14日12时起至V4.1Pro上线前,V4Pro请求将路由至V4.1Flash并按新单价计费。腾讯WorkBuddy、CodeBuddy和OpenCode已接入,调整后的峰谷定价于9月10日12时生效,闲时价格为高峰期一半。

上一篇:

下一篇:

发表回复

登录后才能评论