码厩开发者笔记

coding in a complicated world

DeepSeek V4.1 Flash正式发布

AI DeepSeek LLM 开源模型 国产大模型

9月10日,深度求索正式发布新一代模型 DeepSeek V4.1 Flash。官方称,该模型是新架构系列中目前最小的型号,具备原生多模态视觉理解能力,重点面向更高性能、更快推理和更低成本的Agent应用。V4.1 Flash采用5520亿参数的MoE架构,以及全新的 Causal-Encoder-Decoder 结构,输入阶段仅激活80亿参数,输出阶段激活160亿参数,在降低推理成本的同时提升模型能力。官方测试显示,其Agent相关基准性能超过包括V4 Pro在内的多款旗舰模型。

该模型另一项重点改进是大幅压缩KV Cache,相比上一代对HBM需求降至约四分之一、SSD需求降至约八分之一,有利于降低长上下文和Agent任务成本。V4.1 Flash已上线DeepSeek API,并同步下调价格;9月14日后,原V4 Pro API请求将逐步路由至V4.1 Flash,直到 V4.1 Pro 发布。模型权重也已面向开源社区发布。

如果你有魔法,你可以看到一个评论框~