码厩开发者笔记

coding in a complicated world

开源模型

关注 · Tag · 2 条

DeepSeek V4.1 Flash正式发布

9月10日,深度求索正式发布新一代模型 DeepSeek V4.1 Flash。官方称,该模型是新架构系列中目前最小的型号,具备原生多模态视觉理解能力,重点面向更高性能、更快推理和更低成本的Agent应用。V4.1 Flash采用5520亿参数的MoE架构,以及全新的 Causal-Encoder-Decoder 结构,输入阶段仅激活80亿参数,输出阶段激活160亿参数,在降低推理成本的同时提升模型能力。官方测试显示,其Agent相关基准性能超过包括V4 Pro在内的多款旗舰模型。

该模型另一项重点改进是大幅压缩KV Cache,相比上一代对HBM需求降至约四分之一、SSD需求降至约八分之一,有利于降低长上下文和Agent任务成本。V4.1 Flash已上线DeepSeek API,并同步下调价格;9月14日后,原V4 Pro API请求将逐步路由至V4.1 Flash,直到 V4.1 Pro 发布。模型权重也已面向开源社区发布。

DeepSeek宣布下调Flash系列定价

9月9日,DeepSeek开放平台宣布,自北京时间9月10日12时起,调整Flash系列模型API定价。新价格下,空闲时段每百万Token输入缓存命中0.02元、缓存未命中1元、输出4元;高峰时段价格为0.04元、2元和8元。高峰时段为周一至周五9—12时、14—18时。

与8月17日实施的上一版价格相比,此次调整属于全面降价:输入缓存命中价格由0.05元降至0.02元,降幅达60%;缓存未命中由1.5元降至1元,下降约33%;输出价格由4.5元降至4元,下降约11%。高峰时段价格也同步下调。此次调整意味着DeepSeek再次降低API使用成本,尤其有利于高频调用和大规模AI应用。