2026 年 9 月 8 日,国产大模型公司 DeepSeek(深度求索)公布新一轮招聘计划,开放约 150 个名额,重点面向有 2 至 10 年工作经验的资深工程师,工作地点以北京为主,部分岗位可选杭州。与今年 6 月那轮全部门综合扩招不同,这轮岗位几乎全部集中在工程落地方向——核心信号是:这家以开源模型成名的公司,正把重心从「做研究」转向「做产品与规模化服务」。

先说 DeepSeek 是谁。它是一家总部在杭州的中国 AI 公司,2023 年由量化投资机构幻方量化孵化,走「开源大模型」路线:把自己训练的大模型代码和权重公开,任何人都能下载、研究甚至商用。2025 年初,它发布的推理模型 DeepSeek-R1 性能对标国际头部产品,训练和使用成本却低得多,一度震动全球 AI 圈。这里补两个概念:大模型,就是用海量文本训练出来、能理解并生成文字与代码的 AI 程序;开源,指把程序源码公开,允许他人自由使用和修改。

这轮招的是哪些岗位

DeepSeek 这轮招聘覆盖六个方向:

  • 大模型研究平台:为内部研究人员搭建训练、评估模型的工具与系统,属于「研究的基础设施」;
  • Agent 框架组件:Agent(智能体)指能自主完成多步任务的 AI 程序,比如帮你订机票、写代码、查资料;框架组件就是支撑这类程序开发运行的公共部件;
  • 研发效率基建:给自家工程师用的开发、测试、发布工具,让软件迭代更快;
  • DeepSeek API:API 是「应用程序接口」的缩写,是模型对外提供服务的接入方式;企业付费调用 DeepSeek 的模型能力,走的就是这条通道;
  • 线上服务:保障模型在线上稳定运行,扛得住大量用户同时访问;
  • 数据工程:负责数据的清洗、整理与组织——数据是大模型的「原料」,数据工程决定模型训练的底子。

除「大模型研究平台」偏研究支撑外,其余方向都直接服务于「把模型能力稳定地交付给外部用户」这件事。

与 6 月那轮扩招的差别

今年 6 月,DeepSeek 做过一轮全部门综合扩招,研究、产品、职能等各类岗位都有涉及,性质是「全面补人」。9 月这轮 150 人则高度聚焦工程落地,招聘对象明确锁定 2 至 10 年经验的资深工程师(对特别优秀的候选人,年限要求可放宽)——要的是能直接上手解决工程问题的人。

招聘重心变化说明了什么

把两轮招聘放在一起看,变化很清楚:DeepSeek 正在走一家模型公司从「研究期」到「工程化」的必经之路。做出性能领先的模型只是第一步,要让大量开发者和企业稳定地调用它,中间隔着推理服务稳定性、API 产品化、数据持续供给、内部工具链等一系列工程问题,这轮岗位恰好都压在这个「落地」环节上。

对行业而言这也是一个信号:AI 大模型的竞争,正从「谁家的模型参数更强」延伸到「谁能把模型变成可靠、便宜、好用的服务」。DeepSeek 用招聘方向表明了自己的选择——开源做影响力,工程做商业化。

这轮 150 人的招聘,实质是 DeepSeek 从「模型研究者」向「模型服务商」转身的注脚;接下来值得关注的是,它工程化的节奏能不能跟上外界的期待。