
资讯 · 模型
GPT-5.6 出了:Sol、Terra、Luna 三档区别与价格一次讲清
2026-07-09,OpenAI 把 GPT-5.6 从限量预览转成了全面发布。这次不是发一个模型,是一口气发三档——Sol、Terra、Luna,顺带把命名规则也改了。对我们这些拿模型当龙虾“大脑”的人来说,这次更新值得认真看一眼:价格拉开了明显的档位差,API 侧还塞了几个专门给智能体省钱的新特性。这篇把三档区别、价格、规格、基准和新特性一次讲清,全部数字来自官方发布信息和公开基准页,截至 2026-07-10。
这次发布了什么
GPT-5.6 此前处于限量预览阶段,7 月 9 日起转为全面发布,在 ChatGPT、Codex、OpenAI API、GitHub Copilot 四个入口渐进放量。“渐进放量”的意思是:不是所有账号同一时刻都能看到,你的账号里暂时没刷出来不代表没资格,等等就有,别急着找旁门左道。
命名新规:数字看世代,名字看档位
这次 OpenAI 顺手把命名规则理顺了:数字代表世代(比如 5.6),Sol、Terra、Luna 三个名字代表长期的能力档位——官方明确说了,下一代还会沿用这三个名字。对普通用户这是个好消息:以后不用再背一串乱码型号名,记住“数字看代际、名字看档位”这一句就够了。三个档位的定位是固定的:Sol 永远是旗舰最强,Terra 是强性能低成本,Luna 是最快最省。
三档对照:定位、价格、适合谁
API 定价按每百万 token 计(输入 / 输出),截至 2026-07-10 的官方价,后续以官方页面为准:
| 档位 | 定位 | 输入价 | 输出价 |
|---|---|---|---|
| Sol | 旗舰最强 | $5 | $30 |
| Terra | 强性能低成本 | $2.50 | $15 |
| Luna | 最快最省 | $1 | $6 |
注:三档是同一世代下的能力档位,不是新旧版本关系;表内单价单位为“美元 / 每百万 token”。
规格:1M 上下文、128K 输出
三档共享同一套世代规格:上下文窗口 100 万 token,最大输出 128K token,知识截止 2026-02-16。说人话:一整本厚书塞进上下文没问题,长任务里多轮工具结果堆着也不容易爆窗;知识截止意味着 2026 年 2 月中旬之后发生的事它自己不知道,要靠联网工具补——这对跑智能体的人反而不是大事,龙虾本来就靠工具拿实时信息。
基准怎么看:赢在哪、输在哪,两面都摆
先说赢的一面。在 Agents' Last Exam(覆盖 55 个领域的长程智能体任务基准)上,Sol 拿到 53.6 分,比 Claude Fable 5 高约 13.1 分;Terra 在中档推理设置下也超 Fable 5 约 11.4 分,而成本大约只有其 1/4。其它几项:AA Coding Agent Index v1.1 里 Sol 是 80;OSWorld 2.0(电脑操作)62.6%;Terminal-Bench 在“ultra”四子代理并行模式下从 88.8% 提到 91.9%。
再说输的一面。SWE-Bench Pro(真实软件工程任务)上 Claude Fable 5 仍然更强:80% 对 64.6%。OpenAI 对这个基准提出了质疑,称其中约 30% 的任务本身有缺陷——这个说法你可以听,但分数摆在那里,重度编码场景 Fable 5 占优这件事目前没变。
我们的态度和往常一样:别只信一张榜。长程多步的智能体任务和重度编码是两种活,两张榜各说各的理,都对,也都只对一部分场景。给龙虾选大脑该看哪些指标,通用思路我们在模型选型那篇里写过;这次两家的正面对比,单独写了一篇GPT-5.6 和 Claude Fable 5 怎么选。
API 新特性,说人话版
- Programmatic Tool Calling:以前模型每调一次工具,结果都要塞回对话里再想下一步;现在模型可以自己写一段 JavaScript,在一个隔离的、没有网络的 V8 运行时里把一串工具调用编排着跑完。官方客户案例里 token 消耗降了 38%~63.5%——对跑智能体的人,这是直接写在账单上的数字。
- 多子代理 beta:支持并行 sub-agent,把一个大任务拆给几个子代理同时干。
- 显式 prompt 缓存断点:可以自己指定缓存切在哪,最短缓存生命 30 分钟;注意缓存写入按 1.25 倍输入价计费,不是白送的,量大复用才划算。
- 图像输入新增 detail:original:读图时可要求保留原始细节。
普通人在哪能用上
- ChatGPT:Sol(中高推理档)需要 Plus / Pro / Business / Enterprise 订阅。
- Codex:免费用户直接给 Terra,付费用户三档随便选;推理力度还新增了 max 档。
- API:按上面的三档价格直接调,拿它当龙虾大脑走的就是这条路,接法见接 API 还是接本地模型。
国内用户一句话:官方途径需要订阅、放量是渐进的,或者直接走 API,具体可用情况以 OpenAI 官方页面为准,这里不展开。
常见问题
- GPT-5.6 是什么?
- OpenAI 于 2026-07-09 全面发布的新一代模型,分 Sol、Terra、Luna 三档,在 ChatGPT、Codex、OpenAI API 和 GitHub Copilot 渐进放量。命名新规是:数字代表世代,三个名字代表长期能力档位。
- Sol、Terra、Luna 三档怎么选?
- Sol 是旗舰最强档,留给难题和复杂长程任务;Terra 主打强性能低成本,适合当日常主力;Luna 最快最省,跑大批量轻活。拿不准就从 Terra 起步,不够再升。
- GPT-5.6 价格多少?
- API 定价按每百万 token 计:Sol 输入 5 美元、输出 30 美元;Terra 输入 2.5 美元、输出 15 美元;Luna 输入 1 美元、输出 6 美元。截至 2026-07-10 的官方定价,以官方页面为准。
- GPT-5.6 免费能用吗?
- Codex 的免费用户能用到 Terra 档;ChatGPT 里的 Sol 需要 Plus、Pro、Business 或 Enterprise 订阅。放量是渐进的,账号里暂时没刷到不代表没资格,以官方为准。