DeepSeek Flash系列降价 输出价格降至四元
「DeepSeek宣布自2026年9月10日起调整Flash系列模型定价,输入缓存命中、缓存未命中及输出三档价格全线下调,其中缓存命中降幅达60%,输出价格降至每百万Token四元,高峰时段价格为两倍。」
据DeepSeek开放平台公告,官方将于北京时间2026年9月10日12时起执行Flash系列模型的全新定价方案。本次调价覆盖deepseek-v4-flash和deepseek-v4-flash-vision-exp两款模型,调整幅度保持一致,涉及输入缓存命中、输入缓存未命中以及输出三个计费维度。
从具体价格来看,输入(缓存命中)价格由空闲时段每百万Token 0.05元降至0.02元,高峰时段由0.10元降至0.04元,降幅高达60%;输入(缓存未命中)由空闲时段每百万Token 1.5元降至1元,高峰时段由3.0元降至2元,降幅达到33.33%;输出价格则由空闲时段每百万Token 4.5元降至4元,高峰时段由9.0元降至8元,降幅为11.11%。调整后,用户在空闲时段每调用百万Token输出仅需支付4元,高峰时段则按空闲时段价格的两倍计费。
值得关注的是,此次降价是DeepSeek在近期上调API价格后,对Flash系列产品做出的又一次定价策略调整。三档价格全线下调的举措,体现出DeepSeek在模型推理成本优化和市场竞争策略上的持续发力。对于开发者而言,使用Flash系列模型进行高频调用或大批量推理时,成本压力将得到有效缓解,尤其是缓存命中场景下的费用显著下降,有望鼓励更多应用采用缓存机制来降低单位成本。
本次价格调整也让DeepSeek Flash系列在同类轻量级模型中的性价比进一步提升。随着大模型应用从试验阶段走向规模化落地,API定价的敏感度持续升高。Flash系列模型此番主动降价,或将推动行业在推理服务价格体系上展开新一轮调整,同时为中小型开发团队在构建AI产品时提供更宽松的预算空间。
需要注意的是,新的价格将于2026年9月10日12时正式生效,在此之前仍沿用原有计费标准。开发者团队可提前评估自身调用结构,结合高峰与空闲时段的价格差异,合理规划推理任务调度,从而最大化利用此次降价带来的成本红利。
来源:Heooo AI工具导航