DeepSeek Flash系列明日降价 输出每百万Token降至4元
DeepSeek宣布自2026年9月10日12时起调整Flash系列模型定价,覆盖deepseek-v4-flash及vision-exp两款产品。缓存命中输入价格降幅达60%,输出价格降幅约11%,高峰时段价格为闲时两倍。
DeepSeek开放平台今日发布公告,宣布将于北京时间2026年9月10日12时起,正式执行Flash系列模型的新一轮价格调整方案。本次调价覆盖该系列目前全部两款在售模型,涉及输入与输出两侧的计费标准。
根据公告披露的详细价目,调整后空闲时段内,输入缓存命中价格为每百万Token 0.02元,较此前的0.05元下降60%;输入缓存未命中价格由每百万Token 1.5元降至1元,降幅为33.33%;输出价格则从每百万Token 4.5元下调至4元,降幅为11.11%。高峰时段各项费用均为空闲时段对应价格的两倍,即输入缓存命中0.04元、缓存未命中2元、输出8元每百万Token。
本次调价涉及的Flash系列包含deepseek-v4-flash与deepseek-v4-flash-vision-exp两款模型,前者为通用文本模型,后者面向视觉理解场景。两款模型在此次调整中执行完全一致的新价格标准,降价幅度亦保持同步。
从价格结构来看,缓存命中输入费用的降幅最为显著,达到六成,这或将进一步激励开发者在高频重复请求场景中充分利用缓存机制。而输出侧价格仅下调约11%,反映出推理生成环节的成本压缩空间相对有限。
此次降价距离该系列模型上次价格调整已有数月,新方案将于明日午间正式生效。对于正在使用或计划接入DeepSeek Flash系列的开发者而言,意味着推理成本将出现不同程度的下滑,其中高缓存命中率的应用场景受益最为明显。