码厩开发者笔记

coding in a complicated world

国产大模型

关注 · Tag · 3 条

DeepSeek改变计划:V4 Pro API将继续提供

9月11日,DeepSeek宣布,为响应用户需求,决定在2026年9月14日之后继续提供V4 Pro的API调用服务,现有计费方式保持不变,如有调整将另行通知。

此前,DeepSeek曾计划在9月14日12时之后停止V4 Pro服务,并将相关请求全部路由至新发布的V4.1 Flash,按Flash价格计费。官方此前表示,V4.1 Flash在性能、成本、速度等方面经过测试已全面超越V4 Pro。此次调整意味着V4 Pro暂不会按原计划退出API服务。

DeepSeek V4.1 Flash正式发布

9月10日,深度求索正式发布新一代模型 DeepSeek V4.1 Flash。官方称,该模型是新架构系列中目前最小的型号,具备原生多模态视觉理解能力,重点面向更高性能、更快推理和更低成本的Agent应用。V4.1 Flash采用5520亿参数的MoE架构,以及全新的 Causal-Encoder-Decoder 结构,输入阶段仅激活80亿参数,输出阶段激活160亿参数,在降低推理成本的同时提升模型能力。官方测试显示,其Agent相关基准性能超过包括V4 Pro在内的多款旗舰模型。

该模型另一项重点改进是大幅压缩KV Cache,相比上一代对HBM需求降至约四分之一、SSD需求降至约八分之一,有利于降低长上下文和Agent任务成本。V4.1 Flash已上线DeepSeek API,并同步下调价格;9月14日后,原V4 Pro API请求将逐步路由至V4.1 Flash,直到 V4.1 Pro 发布。模型权重也已面向开源社区发布。

DeepSeek宣布下调Flash系列定价

9月9日,DeepSeek开放平台宣布,自北京时间9月10日12时起,调整Flash系列模型API定价。新价格下,空闲时段每百万Token输入缓存命中0.02元、缓存未命中1元、输出4元;高峰时段价格为0.04元、2元和8元。高峰时段为周一至周五9—12时、14—18时。

与8月17日实施的上一版价格相比,此次调整属于全面降价:输入缓存命中价格由0.05元降至0.02元,降幅达60%;缓存未命中由1.5元降至1元,下降约33%;输出价格由4.5元降至4元,下降约11%。高峰时段价格也同步下调。此次调整意味着DeepSeek再次降低API使用成本,尤其有利于高频调用和大规模AI应用。