DeepSeek 调整 API 计费:周末全天按低谷价,调用成本减半
DeepSeek 自 8月23日起周末全天按低谷价计费,开发者错峰调用成本可减半 国产大模型集体转向价值定价:高峰提价、低谷让利,引导错峰使用算力
前沿大模型的发布、能力与评测
DeepSeek 自 8月23日起周末全天按低谷价计费,开发者错峰调用成本可减半 国产大模型集体转向价值定价:高峰提价、低谷让利,引导错峰使用算力
智谱宣布完成一轮50亿美元融资,约四成来自新股配售、六成来自零息可转债,主投下一代GLM、完全自训练体系与算力基础设施。 2026年智谱累计募资超700亿港元,API收入占比升至86.5%,成为国内融资规模最大的大模型公司。
DeepSeek 宣布取消 V4 Pro 停服计划,9 月 14 日后 API 继续提供、计费不变 新模型 V4.1 Flash 性能更强,价格约为 V4 Pro 的三分之一到七分之一
OpenAI 因旗舰模型 Astra 需求超出算力承载,暂停每月 200 美元的 Pro 套餐新用户注册,已订阅用户不受影响,Plus 与 API 通道继续开放。
OpenAI 9 月 3 日发布新一代旗舰大模型 GPT-6 Astra,发布当天仅部分企业客户可用,付费订阅用户被挡在门外 CEO 萨姆·奥尔特曼次日公开道歉,承诺尽快放开全部付费套餐,并推出按天补偿额度的安抚措施
DeepSeek 正式发布新一代开源大模型 V4.1 Flash:552B 总参数 MoE 结构,智能水平在基准测试中超越自家旗舰 V4 Pro,推理成本显著更低 采用 Causal-Encoder-Decoder 非对称结构与 KV 缓存压缩,HBM 需求降至上一代四分之一,权重与技术报告同步开源,腾讯与 OpenCode 已接入
讯飞星火 X2.5 上线:293B 参数的国产大模型,MoE 架构,实测能拆财报、查数据、搭官网 从训练到部署全流程跑在国产算力芯片上,对国产 AI 芯片产业有风向标意义
DeepSeek(深度求索)是一家 2023 年成立于杭州的中国人工智能公司,由量化投资机构幻方量化孵化,以开源大模型和极低价的模型调用接口(API)闻名,是全球大模型降价潮的主要推动者之一。9 月 9 日,DeepSeek 开放平台发布通……
智谱 GLM-5.3 于 2026 年 8 月 29 日开源权重,AA 综合智能指数 60 分,与 Claude Fable 5、GPT-5.6 Sol 同级,并与 Kimi K3 并列开源模型第一,编程能力较上代提升 50%。
GPT-6 Astra 成为 OpenAI 首个被官方认定达到关键网络安全能力阈值的模型 OpenAI 计划分阶段开放其最强网络安全能力,并以思维链监控等多层护栏对冲风险
DeepSeek 公布新一轮约 150 个岗位的招聘计划,几乎全部集中在工程落地方向,面向 2 至 10 年经验的资深工程师,重心从「做研究」转向「做产品与规模化服务」。
GPT-6 Astra 在 ARC-AGI-3 基准测试中取得当前最高成绩:厂商适配支架下得分 99.9%,标准支架下 62.7% 行动效率首次超过人类基线——96% 的关卡上操作次数少于人类中位数,平均每关少用 51.7% 的操作 ARC Prize 称其为前沿模型能力的阶跃式变化,但明确通过该测试不构成实现 AGI 的证据
Google DeepMind 发布新一代全球天气 AI 模型 WeatherNext 3:空间分辨率提升至 5 公里(约 5 倍)、预报每小时刷新,降水预测精度最高提升 60%,即日起接入谷歌生态。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 与 3.5 Flash-Lite 三款模型上线智能体视频理解能力,视频分析 token 消耗最高降 88%、成本最高降 66%、准确率最高提升 7%。
科大讯飞正式发布星火 Spark-X2.5 多语言文本生成模型:293B-A30B MoE 架构,支持 256K 上下文,基于全国产平台训练 模型已在讯飞星辰 MaaS 平台上线开放调用,输入定价 1.6 元/百万 Token,缓存命中 0.24 元,输出 6 元
2026 年 9 月 3 日,OpenAI 发布新一代旗舰模型 GPT-6 Astra。这次迭代的核心变化不在单点能力,而在能力形态:Astra 可以直接「看」电脑屏幕上的像素,移动鼠标、敲击键盘完成操作,不需要任何软件为它专门开发接口。发布后,OpenAI 总裁 Greg Brockman 公开表态:「我个人认为,我们可能已经到达 AGI 了,我觉得就是这个模型。」在 ARC-AGI-3 推理测 Astra 已经能把「跨软件完整工作流自动化」做成现实产品,它与上一代的差距,是近两年模型迭代中少见的量级跨越。
OpenAI 发布新模型 Astra,主打计算机与浏览器操作,号称迄今最强、最难审计 「不透明循环」推理技术引发可审计性争议,公司高管正面回应 AGI 提问
OpenAI 发布新一代旗舰模型 GPT-6 Astra 与 Astra Pro,从回答问题转向直接完成工作,可操作电脑与浏览器交付文档、表格与工程 API 定价为上一代 2.5 倍,多项基准接近满分,OSWorld 2.0 单任务耗时减少约 47%
社区流出的 OpenAI「Astra」(传闻为下一代旗舰 GPT-6)灰测 demo 展示近乎无需人工反馈的 3D 资产直出能力;官方尚未认领,发布时间待定。
9 月 14 日起 Claude Code 周额度永久上调 25%,但临时 50% 加量同日结束,实际可用约减 17%;OpenAI Codex 同期重置额度并修复多项后台多耗用量 Bug。
谷歌 9 月 2 日在 DeepMind 网站低调上线 Gemini 3.8 Flash,1M 上下文 + 64K 输出 面向软件工程与智能体任务,支持自定义努力水平,主打低成本生产级部署
谷歌发布 Gemini 3.8 Flash Cyber 安全专用模型,漏洞挖掘成功率突破 70%,并通过 Fairwind 计划向受信任安全团队开放。 在 CyberGym 基准超过前代与多款前沿大模型,Chrome 安全团队实测有效补丁产出量达顶尖商业模型的 2.6 倍。
2026年8月,OpenRouter 全球月度榜前六名全部为中国开源模型,中国开源模型全球下载量占比达41%,首次超过美国。 DeepSeek、智谱、小米、腾讯、MiniMax 等厂商 API 定价普遍为美国同类产品的 1/5 至 1/10,能力与价格共同推动这轮集体登顶。
Anthropic 发布 Fable 5.1 与 Mythos 5.1 双版本旗舰模型,首次在 Fable 上启用零数据保留(Zero Data Retention),并降低 token 成本、减少安全防护误报限制 企业客户可在自有基础设施上运行 Anthropic 模型,数据不外流,监控方式由客户自己控制
上周在海外匿名爆火的模型「牛来」(Ox Alpha),真身于 8 月 26 日正式确认:它来自智谱,是 GLM 系列首个原生多模态模型 GLM-5.3 Flash。这款模型总参数 320B、实际激活参数仅 18B,训练与推理全部跑在国产芯片
阿里开源原生多模态稠密大模型 Qwen3.8-27B,原生支持 262K tokens 上下文,可扩展至 1M 昇腾平台在模型开源次日即完成适配,支持 W8A8 量化与 MTP 投机推理,实现当天发布、当天可用
月之暗面开放 Kimi K3 完整权重,中国开源模型三个月内第三度发布:DeepSeek 主打价格,智谱 GLM-5.2 聚焦长程任务,K3 冲击超长软件工程能力 中国开放权重模型在多项基准上逼近美国闭源旗舰,硅谷与华盛顿围绕「开放还是封闭」的政策争论同步升温
OpenAI 更新 ChatGPT 默认模型:免费与 Go 用户改用 GPT-5.6 Luna,Plus 与 Pro 用户获得带思考强度滑杆的 GPT-5.6 Sol,共同取代 GPT-5.5 Instant 系统卡首度公布 U18 未成年人专项评测;生物、化学、网络安全三项定级 High;幻觉率相比前代大幅下降
Anthropic 冲刺 2 万亿美元估值 IPO,但旗舰模型 Fable 5 收入仅占公司模型总收入的 11% 企业客户从「默认换最新」转向按性价比选型,高溢价旗舰模型的定价权正被中间档位模型蚕食 公司整体收入仍在加速增长,2026 年 Q2 实现盈利,但竞争(OpenAI 提速)正在重新加剧