DeepSeek 调整 API 计费:周末全天按低谷价,调用成本减半
DeepSeek 自 8月23日起周末全天按低谷价计费,开发者错峰调用成本可减半 国产大模型集体转向价值定价:高峰提价、低谷让利,引导错峰使用算力
可公开获取权重的开源大模型
DeepSeek 自 8月23日起周末全天按低谷价计费,开发者错峰调用成本可减半 国产大模型集体转向价值定价:高峰提价、低谷让利,引导错峰使用算力
智谱宣布完成一轮50亿美元融资,约四成来自新股配售、六成来自零息可转债,主投下一代GLM、完全自训练体系与算力基础设施。 2026年智谱累计募资超700亿港元,API收入占比升至86.5%,成为国内融资规模最大的大模型公司。
DeepSeek 宣布取消 V4 Pro 停服计划,9 月 14 日后 API 继续提供、计费不变 新模型 V4.1 Flash 性能更强,价格约为 V4 Pro 的三分之一到七分之一
DeepSeek 正式发布新一代开源大模型 V4.1 Flash:552B 总参数 MoE 结构,智能水平在基准测试中超越自家旗舰 V4 Pro,推理成本显著更低 采用 Causal-Encoder-Decoder 非对称结构与 KV 缓存压缩,HBM 需求降至上一代四分之一,权重与技术报告同步开源,腾讯与 OpenCode 已接入
DeepSeek(深度求索)是一家 2023 年成立于杭州的中国人工智能公司,由量化投资机构幻方量化孵化,以开源大模型和极低价的模型调用接口(API)闻名,是全球大模型降价潮的主要推动者之一。9 月 9 日,DeepSeek 开放平台发布通……
智谱 GLM-5.3 于 2026 年 8 月 29 日开源权重,AA 综合智能指数 60 分,与 Claude Fable 5、GPT-5.6 Sol 同级,并与 Kimi K3 并列开源模型第一,编程能力较上代提升 50%。
DeepSeek 公布新一轮约 150 个岗位的招聘计划,几乎全部集中在工程落地方向,面向 2 至 10 年经验的资深工程师,重心从「做研究」转向「做产品与规模化服务」。
上周在海外匿名爆火的模型「牛来」(Ox Alpha),真身于 8 月 26 日正式确认:它来自智谱,是 GLM 系列首个原生多模态模型 GLM-5.3 Flash。这款模型总参数 320B、实际激活参数仅 18B,训练与推理全部跑在国产芯片
阿里开源原生多模态稠密大模型 Qwen3.8-27B,原生支持 262K tokens 上下文,可扩展至 1M 昇腾平台在模型开源次日即完成适配,支持 W8A8 量化与 MTP 投机推理,实现当天发布、当天可用
月之暗面开放 Kimi K3 完整权重,中国开源模型三个月内第三度发布:DeepSeek 主打价格,智谱 GLM-5.2 聚焦长程任务,K3 冲击超长软件工程能力 中国开放权重模型在多项基准上逼近美国闭源旗舰,硅谷与华盛顿围绕「开放还是封闭」的政策争论同步升温