DeepSeek V4.1 Flash 是一款具备原生多模态视觉理解能力的轻量化模型,旨在实现更高的能力上限、更快的推理速度、更大的吞吐量,并具备向更大参数模型扩展的潜力。核心架构上,V4.1 Flash 采用 552B 参数的 MoE(混合专家)架构,并创新性地引入全新的 Causal-Encoder-Decoder 结构。鉴于 V4.1 Flash 在性能、费用、速度和总用时上已全面超越 V4 Pro,官方计划有序下线 V4 Pro 模型:在 2026 年 9 月 14 日 12:00 之后至 V4.1 Pro 上线之前,所有访问 deepseek-v4-pro 的请求将全部被路由至 V4.1 Flash 并按其单价计费。

