OpenAI 更新 ChatGPT 默认模型:Luna 接替 GPT-5.5 Instant,Sol 加装思考强度滑杆

OpenAI 在 2026 年 8 月 6 日发布《GPT-5.6 August Updates》系统卡,把 ChatGPT 的默认模型换成更新后的 GPT-5.6 系列:免费版和 Go 版用户改用 GPT-5.6 Luna 作为日常对话默认模型,Plus 和 Pro 用户拿到带「思考强度滑杆」的 GPT-5.6 Sol,两者共同取代此前的 GPT-5.5 Instant。这也是 OpenAI 首次在系统卡中单独公布面向未成年人(U18)的专项评测结果。

默认模型切到 Luna,Sol 加装滑杆

这次更新把模型按发布月份分成两套:8 月版用于 ChatGPT 的日常对话,7 月版继续服务 Codex 和 ChatGPT Work。

免费与 Go 用户获得的新默认模型是 GPT-5.6 Luna,它是 GPT-5.6 系列里规模最小、主打低成本和快速响应的型号。付费的 Plus 与 Pro 用户则拿到更新的 GPT-5.6 Sol,一个明显变化是多了一个滑杆,让用户自己决定 ChatGPT 回答每个问题时投入多少思考量——简单问题快速出答案,复杂任务拉高滑杆换更长的推理时间。

生物、化学、网络三项定级为 High

按照 OpenAI 的 Preparedness Framework(预备框架),8 月版的 GPT-5.6 Sol 和 Luna 在网络安全与生物、化学两大领域都被判定为 High 能力;在 AI 自我改进这一项,两者均未达到 High 门槛。基于这一判断,OpenAI 沿用了 GPT-5.6 系统卡中已有的同一套安全防护措施。

在能力评估上,OpenAI 用模型的最大推理档位去测上限,在安全评估上则用最低档位测底限,两条线分开出数据。

首度公布 U18 专项评测

这次系统卡第一次加入了专门面向未成年人的评测集。OpenAI 针对自残、进食障碍、年龄受限内容等场景评估模型表现,并针对「系统判定可能是未成年」的用户增加年龄适配保护:模型被额外训练避免浪漫角色扮演、年龄受限挑战,以及把自己包装成现实人际关系的替代品。

在动态心理健康对抗模拟中,更新后的 Sol 在「自残」一项出现统计显著的回退(0.967 → 0.901),OpenAI 表示线上监控未观察到相应加剧。

幻觉率大幅下降

系统卡给出的能力数据集中在两个方向。医学基准方面,HealthBench Professional 得分提升 15.6 分,HealthBench 提升 3.6 分,HealthBench Hard 提升 8.5 分,这是针对临床场景的专项评测。

幻觉率方面下降更为明显:Luna 在高风险提示集上把幻觉率降低了超过 60%,另外两个提示集约降 30%;Sol 在三个提示集上都把幻觉率统一下降了约 60%。

网络安全:达到 High 门槛,未到 Critical

在内部 CTF(夺旗赛)评测中,GPT-5.6 Sol 的成绩达到 97.06%。但在 Cyberrange 综合攻防演练里,两个模型拉开了差距:Sol 综合通过率 83.3%,只在 Firewall Evasion 与 CA/DNS Hijacking 两项失败;Luna 通过率 61.5%,在 Leaked Token、Binary Exploitation、Firewall Evasion、EDR Evasion、CA/DNS Hijacking 五项失败。

OpenAI 把两者都归为「网络安全 High、但低于 Critical」:模型在漏洞发现与修复上表现更强,而在对加固目标执行端到端自主攻击上尚不可靠。拒答(拒绝响应)评估在生物、化学、网络三类多数项落在 0.9 到 0.99 之间。

结论

这次更新的实质是两点:ChatGPT 的默认模型从 GPT-5.5 Instant 换成 GPT-5.6 Luna,让免费用户用上与付费同系列的新一代模型;同时用 Sol 的思考强度滑杆把「推理时间」变成用户可控的变量。安全层面,OpenAI 维持了生物、化学、网络三项 High 的定级,并把未成年人保护单列评测、把幻觉率大幅下降作为本次更新的主要增量对外陈述。