DeepSeek(深度求索)是一家 2023 年成立于杭州的中国人工智能公司,由量化投资机构幻方量化孵化,以开源大模型和极低价的模型调用接口(API)闻名,是全球大模型降价潮的主要推动者之一。9 月 9 日,DeepSeek 开放平台发布通知:计划于北京时间 9 月 10 日前后正式发布新一代模型 V4.1 Flash,并宣布 Flash 系列新定价于 9 月 10 日 12 时生效。
核心信息是:官方称 V4.1 Flash 在性能、费用、速度、总用时等各项指标上已全面超越上一代旗舰 V4 Pro;在 V4.1 Flash 上线后、V4.1 Pro 上线前,所有对 V4 Pro 的请求会自动切换到 V4.1 Flash,并按新单价计费。对正在使用 DeepSeek 接口的开发者而言,这意味着更强的模型、更低的账单。
本文涉及三个基础概念:大模型是用海量文本训练出来、能理解和生成文字的 AI 程序;API 是开发者调用模型服务的程序接口,按使用量计费;Token 是计费的最小单位,可理解为模型处理文本的字数刻度。
V4.1 Flash:新一代高性价比模型
V4.1 Flash 属于 DeepSeek 的 Flash 系列。该系列定位高性价比:相比 Pro 系列更快、更便宜,适合开发者把模型能力批量接入自己的产品。
按官方披露:
- 中间版本已于 9 月 8 日在官方交流群内测,采用新的模型结构;
- 原生多模态支持:一个模型直接处理文字、图片等多种内容(多模态指同时支持多种类型的输入),无需再等专门的视觉版本;
- 能力更强、速度更快、成本更低。
过渡期安排:V4 Pro 的请求自动切到 V4.1 Flash
DeepSeek 在通知中说明:「在 V4.1 Flash 正式上线之后、V4.1 Pro 上线之前,我们会将对 V4 Pro 的请求全部路由到 V4.1 Flash,并按 V4.1 Flash 单价计费。」
意思是:这段时间开发者调用 V4 Pro 接口,实际获得的是 V4.1 Flash 的服务,账单也按 Flash 新价格计算,不需要任何手动操作。
Flash 系列新定价:9 月 10 日 12 时起
DeepSeek 宣布自 9 月 10 日 12 时起执行 Flash 系列新价格,分空闲时段与高峰时段两档,高峰时段价格均为空闲时段的两倍:
- 输入·缓存命中:空闲 0.02 元 / 百万 Token,高峰 0.04 元;
- 输入·缓存未命中:空闲 1 元 / 百万 Token,高峰 2 元;
- 输出:空闲 4 元 / 百万 Token,高峰 8 元。
「缓存命中」指请求内容之前已被模型处理过、结果可以直接复用,机器不用重新计算,所以价格极低;「未命中」则需要完整计算,价格更高。
对开发者和行业的影响
对开发者与企业:Flash 系列价格大幅下调,叠加过渡期 V4 Pro 请求自动切换,意味着同样的预算可以调用更多模型能力,DeepSeek 延续高性能加低价路线。
对行业:DeepSeek 曾在 2025 年以开源模型与低价 API 引发全球大模型降价潮,这次发布与降价延续同一策略,会继续压低大模型 API 的市场价格。
结论:9 月 10 日前后 V4.1 Flash 上线、同日 12 时 Flash 系列降价生效,旧的 V4 Pro 请求也自动切到新一代模型——DeepSeek 用户明天起将获得更强的模型和更低的单价。