DeepSeek 撤回 V4 Pro 下线计划,API 服务延续且计费不变
DeepSeek 宣布 2026 年 9 月 14 日后继续提供 V4 Pro API 服务,计费方式不变。此前公司曾计划将请求路由至 V4.1 Flash 并于 9 月 14 日下线该服务。V4 Pro 输入缓存未命中高峰时段每百万 tokens 收费 9 元,输出高峰时段 27 元。
DeepSeek 于 9 月 11 日调整了其模型服务下线安排,决定在 2026 年 9 月 14 日之后继续保留 DeepSeek V4 Pro 的 API 调用通道,且计费标准维持原样。这一决定是对用户需求的直接回应,也意味着此前公布的下线时间表被正式搁置。
回顾事件经过,DeepSeek 在 9 月 9 日曾表示,在 V4.1 Pro 上线前会将所有 V4 Pro 请求路由至 V4.1 Flash,并按后者单价结算。次日,公司又将 V4 Pro 的下线时间推迟至北京时间 2026 年 9 月 14 日 12:00。如今这一期限被进一步取消,V4 Pro 得以继续以独立模型身份对外服务。
根据官方公布的价目表,V4 Pro 的计费按输入缓存命中与否、空闲或高峰时段区分。百万 tokens 输入缓存命中时,空闲时段为 0.15 元,高峰时段为 0.30 元;缓存未命中时,空闲时段 4.5 元,高峰时段 9.0 元。输出侧,空闲时段每百万 tokens 收费 13.5 元,高峰时段为 27.0 元。作为对比,deepseek-flash 的对应价格明显更低。
值得关注的是,DeepSeek 在 9 月 10 日刚发布了 V4.1 Flash 模型。该模型是全新模型结构系列中尺寸最小的版本,具备原生多模态视觉理解能力,并在基准测试中超越了包括 V4 Pro 在内的多款旗舰模型。V4 Pro 服务得以延续,为依赖该模型的开发者提供了更长的迁移窗口,也保留了在高负载场景下按需选用不同模型的灵活性。