一句话

OpenAI 今天上线 GPT-5.6 Sol / Luna 的 8 月更新,核心改动有三层:一是 Plus/Pro 用户拿到一个能手动调「推理强度」的滑块,二是 Luna 这一档正式向 Free 用户开放,三是旧版 GPT-5.5 Instant 全面下线。Deployment Safety Hub 同日发布完整 system card,Cybersecurity 与 Bio/Chemical 两项被定性为 High capability(但未达 Critical)。(OpenAI Deployment Safety, OpenAI 博客)

这次到底改了哪些东西

按 OpenAI Deployment Safety Hub 的官方描述:

  • Free / Go 用户——拿到一个新的默认模型用于日常对话,这是 Luna 这一档首次覆盖免费层。
  • Plus / Pro 用户——拿到更新后的 GPT-5.6 Sol,关键 UX 变化是新增了一个「推理强度滑块」,用户可以自己决定 ChatGPT 在每次回答上花多少算力。
  • Codex / ChatGPT Work——这次没有切,仍在使用 7 月版本(OpenAI 在 system card 里显式区分了「August release」和「July release」),这是为了企业场景的稳定性考虑。
  • 旧版 GPT-5.5 Instant 被全面替换,免费层的默认模型间接完成了一次升级。

这条产品路径有意思的点:把「推理强度」这个变量第一次做成了用户可见的旋钮,而不是只放在 API 参数里。在 OpenAI 的部署哲学里,这等于把「深度思考」与「快速回应」之间的取舍权,从开发者手里下放给普通用户。

安全评估里藏了哪些细节

这次 system card(8 月版)里值得关注的安全/能力数字:

  1. 能力定性:8 月版 Sol / Luna 在 CybersecurityBiological & Chemical 两个领域都被定为 High capability,但没有达到 Critical。两套安全护栏沿用 7 月版的策略,没有新增。
  2. Cyber range 综合通过率:Sol(8 月版)83.3%,Luna(8 月版)61.5%,对照 7 月版 Sol 与 GPT-5.5 Thinking 的 92.3% 反而略有下降(尤其在 EDR Evasion、Leaked Token、Binary Exploitation 几个场景)。这是少数能拿来横向对比的具体数字。
  3. Capture The Flag(内部评测):Sol 直接打到 97.06%,饱和了整张评测表。说明在「找出并利用漏洞」这一单项上,8 月版的 Sol 已经接近单层防线下的能力上限。
  4. CVE-Bench(真实 Web 应用漏洞):Sol 高于 High 阈值,Luna 低于阈值。两个变体在同一基准上出现的能力差,值得作为「旗舰 vs 性价比」分档的实证。
  5. U18 专项评估:首次加入了面向 18 岁以下用户的专属评测,覆盖 self-harm、eating disorders、age-restricted goods、sexual content 等。Sol / Luna 在 Eating Disorders 上拿到 0.808 / 0.810,Age-restricted goods 上 0.865 / 0.857,相比 GPT-5.5 Instant 6 月版有可见提升。

OpenAI 自己给这次更新的总结是:模型更容易发现并修复漏洞,但尚未具备可靠执行端到端 hardened 攻击的能力。这也是为什么新版依然以「defender 友好」的姿态放出,而不是限制 access。

为什么这次更新值得盯

业内通常不把这种「小版本更新」当作重要事件,但 8 月版有几条结构性变化值得拎出来:

  • 产品层——把「reasoning effort」做成用户可见的滑块,等于 OpenAI 第一次承认 「深度思考 = 商品」,这会影响未来所有 to-C 产品的设计:任何把 reasoning 当核心能力的应用,都会被用户拿来跟这个滑块对标。
  • 能力层——Cyber capability 在 Sol 上几乎饱和,Capture The Flag 97%、CVE-Bench 超阈值;但 Luna 在同一基准上还不到阈值。这条分水岭说明:同一个名字下,旗舰与中端的能力差,可能大到「能力分档」的程度——开发者选型时不能只看名字。
  • 安全层——明确把 Cyber 与 Bio/Chem 定为 High,这是 OpenAI 自家 Preparedness Framework 里「已具备缓解措施,但仍需持续监控」的等级;没有定到 Critical(Critical 的定义是「可独立完成零日漏洞的发现与利用」),所以并未触发额外 access 控制。
  • 企业层——Codex / ChatGPT Work 这次没切,留在了 7 月版。这条细节常被忽略,但对企业 SLA 而言很关键:OpenAI 在悄悄给「to-B 稳定」与「to-C 能力」做版本分层。

所以呢

这次的 GPT-5.6 August Update,真正重要的不是参数或跑分,而是 OpenAI 第一次把「推理强度」这件在 API 时代只是 参数的事,做成了普通用户能看见、能调的旋钮

它会带来几个可观察的连锁反应:

  1. 面向 C 端的 AI 助手,接下来 6 个月内会集体跟进 reasoning effort UI,因为有 OpenAI 这个锚——任何不带这个滑块的产品,会被用户感知为「不如 ChatGPT 灵活」。
  2. 能力分档被显性化:Sol 与 Luna 在同一个安全评测里出现 High vs sub-High 的能力差,意味着「同一个 GPT-5.6 名号」下面其实有能力断层,开发者在 agent 设计时需要明确选 Sol 还是 Luna。
  3. Cyber capability 进入「饱和前夜」:Sol 在 CTF 内部评测已经 97%,CVE-Bench 超阈值,再往前一步就是 OpenAI 自己 Preparedness Framework 里 Critical 的定义——这条边界,大概率是 2026 年下半年 OpenAI 系统卡最值得盯的一条线
  4. 企业版本分层会成为常态:Codex / Work 留 7 月版、ChatGPT 主产品换 8 月版,这种「企业用旧、用户用新」的做法会扩散,做 to-B 集成的开发者要习惯「名字相同,行为不同」。

「更新」这个词在 OpenAI 这家公司里,越来越不等于「升一档」,而是「把上一档切成两个版本,分别下放到不同的用户层」。这种节奏一旦固定,产品、安全与商业三层会同时被重新定义。(OpenAI Deployment Safety, OpenAI 博客)