DeepSeek-V4-Flash
深度求索
热门 已备案 —
输入价格
¥1.5/ 百万 token
输出价格
¥4.5/ 百万 token
上下文
1M
免费额度
注册赠送(按量计费)
轻量高性价比
适用场景
场景聚合 · Token 包参考
轻量体验包 ¥7.5
按空闲时段输出计价估算
常规生产包 ¥450
按输入输出混合比 1:1 估算
缓存优化包 ¥5
缓存命中输入价 ¥0.05/百万
Token 包为按刊例价的估算参考,实际支出以用量结构为准;厂商官方资源包以购买页为准。
查看官方定价文档 ↗ 价格以厂商官网为准,本站每日核对
简介
DeepSeek-V4-Flash 是第四代轻量模型,支持 1M 上下文与 384K 最大输出,输入高峰时段 ¥3.0/百万、空闲时段减半 ¥1.5/百万;缓存命中低至 ¥0.05/百万,输出 ¥4.5-9.0/百万。适合高并发生产环境与长上下文场景。
DeepSeek-V4-Flash 是深度求索第四代轻量旗舰,官网定价页显示其支持 1M 上下文窗口与最大 384K 输出,同时兼容 OpenAI 与 Anthropic 两种 API 格式,并提供思考与非思考双模式切换。
定价采用时段差异化机制:北京时间周一至周五 9:00-12:00、14:00-18:00 为高峰时段,输入(缓存未命中)¥3.0/百万 tokens,其余时间归为空闲时段,价格减半至 ¥1.5/百万。缓存命中的输入成本更是低至高峰 ¥0.10、空闲 ¥0.05,创下行业新低。
输出价格同样分时段:高峰 ¥9.0/百万、空闲 ¥4.5/百万。对以输入为主的长文档处理与 RAG 场景,配合缓存命中策略可将综合成本压缩到极低水平。
选型建议:高并发在线服务优先选 Flash 并尽量把批量任务排入空闲时段;若需更强推理能力,可升级至同代 V4-Pro(输入 ¥4.5-9.0/百万,输出 ¥13.5-27.0/百万)。官方保留调价权利,价格以官网页面为准。
本文由新大陆基于公开信息编辑整理
信息来源:深度求索 官方文档 ↗