DeepSeek开放平台正式发布公告,宣布将于北京时间2026年9月10日12:00起,对旗下flash系列模型的定价规则进行全面调整,全新采用峰谷分时计费模式,不同时段的调用价格将按照明确划定的时段区间执行差异化标准。本次定价调整覆盖flash系列模型的全部调用场景,所有接入该系列API的开发者与企业用户,都将在公告指定的生效时间自动切换至新的计费标准,不存在测试、限时优惠或小范围灰度的特殊安排,属于全量正式执行的永久性定价调整。
根据公告公布的全新计费规则,空闲时段的三类核心调用单价分别为:输入缓存命中单价0.02元每百万Token,输入缓存未命中单价1元每百万Token,输出单价4元每百万Token。高峰时段的所有调用价格统一设定为空闲时段对应价格的2倍,不再单独设置其他阶梯计价规则。高峰时段的具体划定范围为北京时间周一至周五的9:00-12:00以及14:00-18:00,除上述明确标注的高峰时段之外,其余所有时间均统一划归为空闲时段,包括周一至周五的其余工作时段、全天的夜间时段,以及周六、周日的全部时长,都将按照空闲时段的对应单价执行计费。
本次定价调整的降价幅度覆盖flash系列模型的全部计费维度,对比调整前的原有价格,不同调用类型的降价比例各有不同。其中空闲时段的输入缓存命中单价从原先的0.05元每百万Token下调至0.02元每百万Token,整体降幅达到60%,是本次调价中降价幅度最高的计费项。空闲时段的输入缓存未命中单价从原先的1.5元每百万Token下调至1元每百万Token,对应降幅为33.33%。空闲时段的输出单价从原先的4.5元每百万Token下调至4元每百万Token,对应降幅为11.11%。高峰时段的对应价格同样同步完成下调,调整前高峰时段的输入缓存命中单价为0.1元每百万Token,调整后降至0.04元每百万Token;调整前高峰时段的输入缓存未命中单价为3元每百万Token,调整后降至2元每百万Token;调整前高峰时段的输出单价为9元每百万Token,调整后降至8元每百万Token,所有高峰时段的计费项均按照空闲时段2倍的规则完成同步下调。
对于有批量处理任务需求的用户而言,选择在空闲时段发起模型调用,能够直接享受本次调价带来的最低成本优惠,其中缓存命中场景下的调用价格仅为调整前原有价格的一成出头,大幅降低了大规模批量任务的整体投入成本。此前不少用户已经形成了将非紧急的批量处理任务安排在夜间等低峰时段运行的使用习惯,本次调价之后,这类错峰使用的成本优势将进一步凸显,能够帮助开发者和企业用户在不影响业务正常运行的前提下,最大化压缩AI模型调用的相关开支。
这已经是DeepSeek近期针对平台计费规则推出的第二次相关调整,此前在8月23日,平台就已经对峰谷计费规则完成了一轮优化,调整后周六、周日全天不再区分峰谷时段,统一执行低谷时段的计费价格,进一步扩大了低价空闲时段的覆盖范围。而在更早的8月17日,DeepSeek刚刚完成对V4系列的峰谷定价调整,当时该系列的高峰调用价格曾出现大幅上调,平台当时的调整背景与算力供需的实际情况直接相关,彼时用户规模在半年内增长66.7%,但算力储备仅增长8.3%,二者之间的剪刀差达到8倍以上,单日Token消耗量突破8万亿,高峰期接口超时、算力挤兑成为常态,平台希望通过价格杠杆引导用户错峰使用,缓解高峰期的服务稳定压力,同时通过合理的价格修复补充算力扩充的相关预算。
本次针对flash系列的定价调整,覆盖该系列旗下的两款主力模型产品,分别是专注纯文本推理、主打运行速度与高性价比的deepseek-v4-flash,以及支持图文混合理解、多模态缓存复用的视觉增强版deepseek-v4-flash-vision-exp,两款模型的所有调用场景都将同步执行全新的峰谷分时计费规则。作为DeepSeek面向高性价比需求用户推出的核心产品线,flash系列自上线以来就主打低调用成本与快速推理能力,主要面向此前因单次调用成本过高而无法落地AI项目的中小开发者、SaaS工具开发者、教育应用运营方以及本地化Agent开发团队,这类用户群体此前普遍受限于AI模型调用的高成本,大量相关的长尾应用场景始终无法顺利落地,本次调价之后,相关场景的使用门槛将进一步降低。
按照本次公告明确的时段划分规则,用户可以清晰规划自身的模型调用安排,将对实时性要求不高的批量数据处理、离线内容生成、历史数据智能分析等任务全部转移至空闲时段运行,同时通过优化自身的调用逻辑提升输入缓存的命中比例,能够进一步压缩整体的调用成本,部分场景下的综合使用成本相比调整前可以削减近一半。此前平台执行的峰谷计费规则中,高峰时段的价格设置相对较高,不少用户为了控制使用成本,不得不主动调整业务运行节奏,本次调价在保留峰谷分时计费核心框架的基础上,同步下调了高峰时段的对应价格,既保留了价格杠杆引导错峰使用的作用,也进一步降低了用户在高峰时段的使用负担,兼顾了算力资源的调度效率与用户的实际使用成本。
从本次调价的具体细则来看,所有价格调整均严格按照公告公示的标准执行,不存在任何隐藏的附加条件或临时限制,全球所有接入flash系列API的开发者,都可以在2026年9月10日12:00之后自动按照新标准结算账单,无需额外提交申请或调整接入配置。本次调整没有改变此前已经明确的峰谷时段划分边界,周一至周五的核心工作高峰时段依然保持原有划定范围,其余时段全部执行低价空闲计费,既保证了高峰期的算力资源能够优先供给有实时性需求的业务场景,也让更多非实时业务能够在低峰时段以更低的成本运行,进一步提升整体算力资源的利用效率。 |