深度求索正式发布 DeepSeek V4.1 Flash,这是其新模型结构系列中尺寸最小的模型,支持原生多模态视觉理解。该模型采用全新的 Causal-Encoder-Decoder 架构,总参数量为552B,输入激活参数仅8B、输出激活参数为16B。相比上一代,KV Cache使HBM需求降至四分之一、SSD需求降至八分之一。模型已上线DeepSeek API,旧版V4 Flash及V4 Flash Vision Exp下线。9月14日12时起,V4 Pro请求将路由至V4.1 Flash并按新模型计费。腾讯WorkBuddy、CodeBuddy及OpenCode已完成接入,模型权重和技术报告同步在Hugging Face开放。