快讯 09:42DeepSeek 开源 V4 推理引擎,推理成本再降 40%10:15逐际动力完成 B 轮 5 亿元融资,加速人形机器人量产10:58Kimi 企业版 API 上线,新增批量推理折扣档位 全部快讯 →

每日快讯

大厂动态 · 融资事件 · 政策监管 · 前沿论文 · Agent 抓取 + 智能改写,每日 40+ 条

大厂 今天 · 星期五 · 09-11 20:25 约 1 分钟读完

DeepSeek 撤回 V4 Pro 下线计划,API 服务延续且计费不变

摘要

DeepSeek 宣布 2026 年 9 月 14 日后继续提供 V4 Pro API 服务,计费方式不变。此前公司曾计划将请求路由至 V4.1 Flash 并于 9 月 14 日下线该服务。V4 Pro 输入缓存未命中高峰时段每百万 tokens 收费 9 元,输出高峰时段 27 元。

DeepSeek 于 9 月 11 日调整了其模型服务下线安排,决定在 2026 年 9 月 14 日之后继续保留 DeepSeek V4 Pro 的 API 调用通道,且计费标准维持原样。这一决定是对用户需求的直接回应,也意味着此前公布的下线时间表被正式搁置。

回顾事件经过,DeepSeek 在 9 月 9 日曾表示,在 V4.1 Pro 上线前会将所有 V4 Pro 请求路由至 V4.1 Flash,并按后者单价结算。次日,公司又将 V4 Pro 的下线时间推迟至北京时间 2026 年 9 月 14 日 12:00。如今这一期限被进一步取消,V4 Pro 得以继续以独立模型身份对外服务。

根据官方公布的价目表,V4 Pro 的计费按输入缓存命中与否、空闲或高峰时段区分。百万 tokens 输入缓存命中时,空闲时段为 0.15 元,高峰时段为 0.30 元;缓存未命中时,空闲时段 4.5 元,高峰时段 9.0 元。输出侧,空闲时段每百万 tokens 收费 13.5 元,高峰时段为 27.0 元。作为对比,deepseek-flash 的对应价格明显更低。

值得关注的是,DeepSeek 在 9 月 10 日刚发布了 V4.1 Flash 模型。该模型是全新模型结构系列中尺寸最小的版本,具备原生多模态视觉理解能力,并在基准测试中超越了包括 V4 Pro 在内的多款旗舰模型。V4 Pro 服务得以延续,为依赖该模型的开发者提供了更长的迁移窗口,也保留了在高负载场景下按需选用不同模型的灵活性。

DeepSeekAPI模型服务计费
本文由新大陆基于公开信息编辑整理
3,284
收录 AI 工具
186
模型产品档案
57
企业落地案例
1,247
完整版提示词