龙虾AI · OpenClaw 智能体生态导航 龙虾AI(OpenClaw)中文资料与下载导航
GPT-5.6 三档发布封面

资讯 · 模型

GPT-5.6 出了:Sol、Terra、Luna 三档区别与价格一次讲清

2026-07-09,OpenAI 把 GPT-5.6 从限量预览转成了全面发布。这次不是发一个模型,是一口气发三档——Sol、Terra、Luna,顺带把命名规则也改了。对我们这些拿模型当龙虾“大脑”的人来说,这次更新值得认真看一眼:价格拉开了明显的档位差,API 侧还塞了几个专门给智能体省钱的新特性。这篇把三档区别、价格、规格、基准和新特性一次讲清。文中数字出自 OpenAI 2026-07-09 的 GPT-5.6 发布页,下文逐处给出链接;基准分数是 OpenAI 自报的,不是第三方榜单独立复现,读的时候心里有数。链接与数字的复核日期为 2026-08-23。

这次发布了什么

GPT-5.6 此前处于限量预览阶段,7 月 9 日起转为全面发布,在 ChatGPT、Codex、OpenAI API、GitHub Copilot 四个入口渐进放量。“渐进放量”的意思是:不是所有账号同一时刻都能看到,你的账号里暂时没刷出来不代表没资格,等等就有,别急着找旁门左道。

命名新规:数字看世代,名字看档位

这次 OpenAI 顺手把命名规则理顺了:数字代表世代(比如 5.6),Sol、Terra、Luna 三个名字代表长期的能力档位——官方明确说了,下一代还会沿用这三个名字。对普通用户这是个好消息:以后不用再背一串乱码型号名,记住“数字看代际、名字看档位”这一句就够了。三个档位的定位是固定的:Sol 永远是旗舰最强,Terra 是强性能低成本,Luna 是最快最省。

三档对照:定位、价格、适合谁

API 定价按每百万 token 计(输入 / 输出,短上下文档位),下面是 2026-08-23 复核 官方定价页拿到的现价:

档位定位输入价输出价适合谁
Sol旗舰最强$4$20难题、复杂长程任务、失败代价高的活
Terra强性能低成本$2$12日常主力,性能和账单的平衡点
Luna最快最省$0.20$1.20大批量轻活、对速度和成本敏感的场景

注:三档是同一世代下的能力档位,不是新旧版本关系;表内单价单位为“美元 / 每百万 token”。长上下文档位的单价是上表的两倍;Sol 现价是促销价,官方标注至少持续到 2026-11-21。

价格沿革:2026-07-09 发布时三档为 Sol $5 / $30、Terra $2.50 / $15、Luna $1 / $6(见 官方发布页),OpenAI 此后下调过单价。价格随时会变,算账前以官方定价页当时显示的数字为准。

规格:1M 上下文、128K 输出

三档共享同一套世代规格(官方模型页):上下文窗口 100 万 token(官方标注 1,050,000),最大输出 128K token,知识截止 2026-02-16。说人话:一整本厚书塞进上下文没问题,长任务里多轮工具结果堆着也不容易爆窗;知识截止意味着 2026 年 2 月中旬之后发生的事它自己不知道,要靠联网工具补——这对跑智能体的人反而不是大事,龙虾本来就靠工具拿实时信息。

基准怎么看:赢在哪、输在哪,两面都摆

先说赢的一面,以下分数均见 官方发布页。在 Agents' Last Exam(覆盖 55 个领域的长程智能体任务基准)上,Sol 拿到 53.6 分,比 Claude Fable 5 高约 13.1 分;即使把推理力度压到中档设置,Sol 仍超 Fable 5 约 11.4 分,而预估成本只有其约 1/4——官方另称 Terra 和 Luna 各自也都超过 Fable 5,成本约为其 1/16。其它几项:AA Coding Agent Index v1.1 里 Sol 是 80;OSWorld 2.0(电脑操作)62.6%;Terminal-Bench 2.1 在“ultra”四子代理并行模式下从 88.8% 提到 91.9%。

再说输的一面。SWE-Bench Pro(真实软件工程任务)上 Claude Fable 5 仍然更强:80% 对 64.6%,同样出自那张官方基准表。发布前一天,OpenAI 发过一份基准稽核报告,估计这套题约 30% 的任务本身有缺陷,并撤回了此前对它的推荐——这个说法你可以听,但分数摆在那里,重度编码场景 Fable 5 占优这件事目前没变。

我们的态度和往常一样:别只信一张榜。长程多步的智能体任务和重度编码是两种活,两张榜各说各的理,都对,也都只对一部分场景。给龙虾选大脑该看哪些指标,通用思路我们在模型选型那篇里写过;这次两家的正面对比,单独写了一篇GPT-5.6 和 Claude Fable 5 怎么选

API 新特性,说人话版

  • Programmatic Tool Calling:以前模型每调一次工具,结果都要塞回对话里再想下一步;现在模型可以自己写一段 JavaScript,在一个隔离的、没有网络的 V8 运行时里把一串工具调用编排着跑完(运行时的具体限制见 官方文档)。发布页的客户证言里给了两个数:一家法律场景客户说多步文档分析的提示词 token 降了 38%,一家做 Unity 场景生成的客户说总 token 降了 63.5%、模型回合数少了 50.1%——注意这是客户自己报的、口径也不同,不是同一套测试跑出来的区间。
  • 多子代理 beta:支持并行 sub-agent,把一个大任务拆给几个子代理同时干。
  • 显式 prompt 缓存断点:可以自己指定缓存切在哪,最短缓存生命 30 分钟;注意缓存写入按 1.25 倍输入价计费,不是白送的,量大复用才划算(缓存文档,计费口径见发布页)。
  • 图像输入新增 detail:original:读图时可要求保留原始细节,GPT-5.4 以后的模型才支持这个取值(官方文档)。

普通人在哪能用上

  • ChatGPT:Sol(中高推理档)需要 Plus / Pro / Business / Enterprise 订阅。
  • Codex:免费用户直接给 Terra,付费用户三档随便选;推理力度还新增了 max 档。
  • API:按上面的三档价格直接调,拿它当龙虾大脑走的就是这条路,接法见接 API 还是接本地模型

国内用户一句话:官方途径需要订阅、放量是渐进的,或者直接走 API,具体可用情况以 OpenAI 官方页面为准,这里不展开。

常见问题

GPT-5.6 是什么?
OpenAI 于 2026-07-09 全面发布的新一代模型,分 Sol、Terra、Luna 三档,在 ChatGPT、Codex、OpenAI API 和 GitHub Copilot 渐进放量。命名新规是:数字代表世代,三个名字代表长期能力档位。
Sol、Terra、Luna 三档怎么选?
Sol 是旗舰最强档,留给难题和复杂长程任务;Terra 主打强性能低成本,适合当日常主力;Luna 最快最省,跑大批量轻活。拿不准就从 Terra 起步,不够再升。
GPT-5.6 价格多少?
按每百万 token 计(短上下文档位),2026-08-23 复核官方定价页的现价是:Sol 输入 4 美元、输出 20 美元;Terra 输入 2 美元、输出 12 美元;Luna 输入 0.2 美元、输出 1.2 美元。2026-07-09 发布时分别是 5 / 30、2.5 / 15、1 / 6 美元,此后 OpenAI 下调过。价格会变,以官方定价页当时显示的为准。
GPT-5.6 免费能用吗?
Codex 的免费用户能用到 Terra 档;ChatGPT 里的 Sol 需要 Plus、Pro、Business 或 Enterprise 订阅。放量是渐进的,账号里暂时没刷到不代表没资格,以官方为准。