深度求索发布 DeepSeek V4.1 Flash:552B MoE模型上线并将接替V4 Pro

深度求索正式发布 DeepSeek V4.1 Flash,这是其新模型结构系列中尺寸最小的模型,支持原生多模态视觉理解。该模型采用全新的 Causal-Encoder-Decoder 架构,总参数量为552B,输入激活参数仅8B、输出激活参数为16B。相比上一代,KV Cache使HBM需求降至四分之一、SSD需求降至八分之一。模型已上线DeepSeek API,旧版V4 Flash及V4 Flash Vision Exp下线。9月14日12时起,V4 Pro请求将路由至V4.1 Flash并按新模型计费。腾讯WorkBuddy、CodeBuddy及OpenCode已完成接入,模型权重和技术报告同步在Hugging Face开放。

上一篇:

下一篇:

发表回复

登录后才能评论