9 月 11 日,中国 AI 公司深度求索(DeepSeek)宣布撤回 V4 Pro 模型的停服计划:V4 Pro 的 API 调用服务在 9 月 14 日之后继续提供,计费方式保持不变。就在三天前,这家公司刚刚宣布要在 9 月 14 日下线 V4 Pro,把请求全部切换到新款模型 V4.1 Flash。
先交代主角:DeepSeek 是一家专注大模型研发的中国 AI 公司。大模型是用海量文本训练出来、能理解和生成文字的 AI 程序;公司通过 API(应用程序接口,开发者调用模型能力的通道,按调用量付费)向开发者出售模型的文字处理能力。V4 Pro 是它的旗舰模型,V4.1 Flash 是 9 月 10 日发布的新款模型。
三天内三次调整
DeepSeek 对 V4 Pro 的安排在过去三天里调整了三次:
- 9 月 9 日:宣布在 V4.1 Pro 上线之前,把 V4 Pro 的请求全部路由(转交)到 V4.1 Flash 处理,按 V4.1 Flash 单价计费。
- 9 月 10 日:发布 V4.1 Flash 模型,同时把 V4 Pro 的下线时间推迟到北京时间 9 月 14 日 12:00。
- 9 月 11 日:宣布取消下线,9 月 14 日之后继续提供 V4 Pro API 服务,计费方式不变。
官方给出的理由是「响应广大用户的需求」。
V4.1 Flash 是什么
V4.1 Flash 是 DeepSeek 全新模型结构系列中尺寸最小的成员。它有两个特点:一是具备原生多模态视觉理解能力,能直接看懂图片并回答问题,不需要外挂其他组件;二是在基准测试中,智能水平超过了包括 V4 Pro 在内的一众旗舰模型。
新发布的小尺寸模型在测试中的智能水平已经超过旧旗舰 V4 Pro,价格却便宜得多。
两代模型价格对照
API 按 tokens 计费。tokens 是模型处理文字的最小单位,每百万 tokens 大约对应几十万汉字,费用按处理量累加;「缓存命中」指相同提问再次出现时直接复用上次的计算结果,价格大幅降低。官方价格如下:
| 计费项 | deepseek-flash(V4.1 Flash) | deepseek-v4-pro |
|---|---|---|
| 输入(缓存命中)· 空闲时段 | 0.02 元 | 0.15 元 |
| 输入(缓存命中)· 高峰时段 | 0.04 元 | 0.30 元 |
| 输入(缓存未命中)· 空闲时段 | 1 元 | 4.5 元 |
| 输入(缓存未命中)· 高峰时段 | 2 元 | 9 元 |
| 输出 · 空闲时段 | 4 元 | 13.5 元 |
| 输出 · 高峰时段 | 8 元 | 27 元 |
同一计费档位下,V4.1 Flash 的价格约为 V4 Pro 的三分之一到七分之一。
双轨并存的信号
连续调整说明 V4 Pro 的存量用户需求比官方预期更强:不少长期调用 V4 Pro 的开发者不愿马上迁移。保留 V4 Pro 独立服务、计费不变,等于给这批用户留出无痛过渡期,同时让新模型继续凭价格和性能竞争。
对开发者来说,实际变化是:V4 Pro 不会在 9 月 15 日突然不可用,现有代码和计费逻辑都不用改;想省钱提速的,可对照官方价格表评估迁移到 V4.1 Flash。
结论:DeepSeek 取消了 V4 Pro 的下线计划,9 月 14 日之后照常提供服务、价格不变;新模型 V4.1 Flash 性能更强、价格约为 V4 Pro 的三分之一到七分之一。双轨并存期间,用户可按需选择。