快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

DeepSeek-V4-Flash

深度求索 · API 定价、上下文与选型参考 · 数据每日核对

DeepSeek-V4-Flash
深度求索
热门 已备案
输入价格
¥1.5/ 百万 token
输出价格
¥4.5/ 百万 token
上下文
1M
免费额度
注册赠送(按量计费)
轻量高性价比
适用场景
智能客服内容分类长文档理解Agent 调度
场景聚合 · Token 包参考
轻量体验包 ¥7.5
500 万 · 个人试用与原型验证
按空闲时段输出计价估算
常规生产包 ¥450
1 亿 · 日均千万级 token 的业务
按输入输出混合比 1:1 估算
缓存优化包 ¥5
1 亿(缓存命中) · RAG / 长 System Prompt 复用
缓存命中输入价 ¥0.05/百万
Token 包为按刊例价的估算参考,实际支出以用量结构为准;厂商官方资源包以购买页为准。
查看官方定价文档 ↗ 价格以厂商官网为准,本站每日核对
简介

DeepSeek-V4-Flash 是第四代轻量模型,支持 1M 上下文与 384K 最大输出,输入高峰时段 ¥3.0/百万、空闲时段减半 ¥1.5/百万;缓存命中低至 ¥0.05/百万,输出 ¥4.5-9.0/百万。适合高并发生产环境与长上下文场景。

DeepSeek-V4-Flash 是深度求索第四代轻量旗舰,官网定价页显示其支持 1M 上下文窗口与最大 384K 输出,同时兼容 OpenAI 与 Anthropic 两种 API 格式,并提供思考与非思考双模式切换。

定价采用时段差异化机制:北京时间周一至周五 9:00-12:00、14:00-18:00 为高峰时段,输入(缓存未命中)¥3.0/百万 tokens,其余时间归为空闲时段,价格减半至 ¥1.5/百万。缓存命中的输入成本更是低至高峰 ¥0.10、空闲 ¥0.05,创下行业新低。

输出价格同样分时段:高峰 ¥9.0/百万、空闲 ¥4.5/百万。对以输入为主的长文档处理与 RAG 场景,配合缓存命中策略可将综合成本压缩到极低水平。

选型建议:高并发在线服务优先选 Flash 并尽量把批量任务排入空闲时段;若需更强推理能力,可升级至同代 V4-Pro(输入 ¥4.5-9.0/百万,输出 ¥13.5-27.0/百万)。官方保留调价权利,价格以官网页面为准。

DeepSeekV4-Flash分时段定价1M上下文
本文由新大陆基于公开信息编辑整理
其他模型
GLM-5.3
智谱 AI · 输入 ¥0.8 / 输出 ¥2.8
Qwen-Flash
阿里云 · 输入 ¥0.15 / 输出 ¥1.5
豆包 doubao-seed-2.1-pro
字节跳动 · 输入 ¥6.0 / 输出 ¥30.0
小米 MiMo-V2.5-Pro
小米 · 输入 ¥3.0 / 输出 ¥6.0
美团 LongCat-2.0
美团 · 输入 ¥2.0 / 输出 ¥8.0
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词