DeepSeek V4.1 Flash 正式发布:552B MoE,新架构大幅压缩 KV Cache
DeepSeek V4.1 Flash 正式发布:552B MoE,新架构大幅压缩 KV Cache2026 年 9 月 10 日,DeepSeek 正式发布 V4.1 Flash。官方称其为新架构系列中规模最小的模型,原生支持多模态视觉理解,并针对能力上限、推理速度与吞吐效率进行了重新设计。API 已可通过 deepseek-flash 调用。V4.1 Flash 为 552B 参数的 MoE 模型,采用新的 Causal-Encoder-Decoder 架构。模型在输入与输出阶段采用非对称计算设计,输入侧约激活 8B 参数,输出侧约激活 16B 参数,在保持大模型容量的同时降低实际推理计算...