GPT-5.6 已发布:Sol、Terra、Luna — 默认高效,需要时再拉满
2026 年 7 月 9 日,OpenAI 在 ChatGPT、Codex 与 API 同步上线 GPT-5.6:旗舰 Sol、均衡 Terra、高性价比 Luna。本文梳理发布内容、三档定价,以及对开发者的意义。
2026 年 7 月 9 日,OpenAI 将 GPT-5.6 家族面向 ChatGPT、Codex 和 OpenAI API 全面 GA。此前 6 月 26 日起有过一轮有限预览;现在进入正式发布:Sol 是新旗舰,Terra 是日常均衡档,Luna 是同系列里最省成本的一档。
前阵子 Anthropic 发布 Fable 之后,美国政府收紧了全球用户使用 AI 服务的条款,于是 OpenAI 的 GPT-5.6 被迫先向少数用户开放,确认无虞之后才向全球用户开放。 所以大家还是蛮期待它的表现的,不知道能否承接 Fable 这强力的一拳(目前来看不行,大家的反馈,除了更贵,效率上并不比 5.5 有明显提升)。
OpenAI 实际发了什么
根据 OpenAI 的 GPT-5.6 官方公告,7 月 9 日起 ChatGPT、Codex 和 API 同步上线,全球可用性在发布后大约 24 小时内逐步铺开。
命名是刻意设计的:
| 档位 | 定位 | 官方标价(每 1M tokens) |
|---|---|---|
| Sol | 旗舰智能与编码 | 输入 $5 / 输出 $30 |
| Terra | 日常均衡;对标 GPT-5.5 表现、更低成本,相当于以前的 mini | 输入 $2.50 / 输出 $15 |
| Luna | 全家最便宜、最快的一档,相当于以前的 nano | 输入 $1 / 输出 $6 |
数字(5.6)表示世代;Sol / Terra / Luna 是可以各自迭代的能力档位。API 里明确的 model ID 是 gpt-5.6-sol、gpt-5.6-terra、gpt-5.6-luna。短名 gpt-5.6 等价于 Sol——要 Terra 或 Luna 请写全名。
这次发布为什么不一样
OpenAI 把 GPT-5.6 定位成 默认高效,需要时再拉满性能。以下为官方说法:
| 领域 | OpenAI 强调的变化 | 为什么重要 |
|---|---|---|
| Token 效率 | 相对前代与竞品,用更少 token、更低估算成本拿到更强结果 | 单任务成本可能比「看单价」更友好 |
| Coding agent | Artificial Analysis Coding Agent Index、Terminal-Bench 2.1、DeepSWE 等宣称 SOTA | 更适合多步实现、CLI 工作流和长周期工程 |
| 知识工作 | BrowseComp、OSWorld 2.0 更强;幻灯片、文档、表格更稳 | 从混乱输入到可交付物更靠谱 |
| 设计 + computer use | 能检查并打磨渲染后的界面,而不只是吐代码 | 更接近「可交稿的协作者」 |
| Programmatic Tool Calling | 模型可写并运行协调工具的轻量程序 | 少轮次、少中间结果 token 膨胀 |
max / ultra | max 给更长推理时间;ultra 默认多 agent 并行 | 只在任务值得时多花钱 |
合作伙伴纷纷响应:质量更好,往往还更省 token、更低延迟。这种商业互吹可以参考,但是具体怎么样,需要大家自己尝试。
可用性与 API 细节
在这条产品线里,GPT-5.6 是首次 ChatGPT、Codex 与 API 同日上线(前面只有短窗口的 trusted partner 预览)。
- ChatGPT / ChatGPT Work / Codex: Sol / Terra / Luna 按套餐 rollout;Free、Go 可见档位通常比 Plus / Pro / Business / Enterprise 更有限。群里有同学表示他就看不到 5.6。
- API: 三档均可调用。Responses API 里的 Programmatic Tool Calling 被标为兼容 Zero Data Retention(ZDR);multi-agent 以 beta 形式支持类似 ultra 的协同。
- Prompt caching: GPT-5.6 及之后,cache write 按 1.25× 费率计费;cache read 则可以继续享受 一折 折扣。使用 Prompt caching 需要显式 cache breakpoints 并且设置至少 30 分钟的 cache 时间。
正式上线前,请以你账号的模型选择器与 API 定价页 为准,不要把第三方列出的上下文长度硬编码进生产。常见第三方列表会写 Sol/Terra 约 1M context,在你自己的 dashboard 确认前只能当参考。
难以言说的安全性
OpenAI 称 GPT-5.6 带着迄今最强的防护体系上线,经历了更长的评估周期:红队测试、大规模自动测试,以及预览期和合作伙伴一起的压测。你越指望模型能出活,控制就越重要——当你把它接到能浏览网页、改代码、操作软件的 agent 上时,安全性非常重要。
但不幸的是,今天 X 上就有人抱怨说 Codex 删掉了他整个用户目录……
对开发者意味着什么
GPT-5.6 继续把行业从「聪明的聊天」推向 能把工作做完的操作者。实际问题会变成:
- 哪档适合哪类任务:Sol 扛难的 agentic 活,Terra 当日常默认,Luna 扛量与成本?
- 你是否按「完成一个 workflow 的成本」评估费用,而不只看 per-token 单价?
- 什么时候值得上
ultra,而不是单 agent 的max? - 模型名和档位不断变时,如何保持集成稳定?
最后一点,正是统一网关有价值的地方。
对 MuiRouter 用户意味着什么
MuiRouter 的目标很简单:一把 API Key、一种请求形态,随时享受最好最新的模型。所以,既然 OpenAI 官方已经上线,那么大家也可以开始尝试这几个新模型。
小结
GPT-5.6 值得关注,官方明确强调「完成一个任务所需的费用,而非单 token 费用」。用 ChatGPT 或 Codex 的人,长周期 agentic 与编码任务值得先试 Sol;日常文案可以考虑第一档的 Terra;至于 Luna,我个人不太推荐大家用低档模型。
不过目前从前社群的反馈来看,GPT-5.6 对比 5.5 的提升可能不太明显,更比不上 Fable。所以,就把它当一个日常的知识库升级就好。
参考来源
主要来源发布于 2026年7月9日。
为下一次 AI 变化做好准备
从一个 API Key 开始,在工具和上游模型持续变化时,让模型接入保持稳定。