
选型 · 实战
龙虾AI 接 Claude Opus 5:配置、effort 调法与成本账
Claude Opus 5 是 Anthropic 官方文档现在推荐的默认起手模型,model ID 就是 claude-opus-5,100 万 token 上下文,最大输出 12.8 万 token,API 价格每百万 token 输入 $5、输出 $25——和 Opus 4.8 完全同价,只有 Claude Fable 5 的一半。拿它给龙虾AI(OpenClaw)当大脑,配置层面就是换一行模型名;真正绊人的是另外三件事:从 4.8 迁过来有几种老写法会当场报 400、effort 该定在哪一档、月底账单长什么样。这篇只讲 Opus 5 这一款怎么接怎么调,不做泛泛的模型横评。文中规格和价格来自 Anthropic 官方模型总览,查证日期 2026-08-23,以官方页面为准——价格和 beta 特性随时会变。
Opus 5 在龙虾这儿是什么位置
官方模型总览页开篇那句话写得很直白:不确定用哪个,就从 Claude Opus 5 起步,它面向复杂的智能体编码和企业级工作;要更高上限,才去用 Claude Fable 5。这句话对龙虾用户几乎是量身定做的——龙虾干的就是智能体循环那点事:读任务、调工具、看返回、决定下一步,一圈一圈转到完成。
四款现役模型摆一起,在龙虾场景里的位置大致如此:
| 模型 | model ID | 上下文 / 最大输出 | 在龙虾里的角色 |
|---|---|---|---|
| Claude Fable 5 | claude-fable-5 | 1M / 128K | 上限最高,价格也最高。留给真的啃不动的活。 |
| Claude Opus 5 | claude-opus-5 | 1M / 128K | 官方推荐的默认起点。多步工具调用的日常主力。 |
| Claude Sonnet 5 | claude-sonnet-5 | 1M / 128K | 速度与智力的平衡档,量大的中等任务放这。 |
| Claude Haiku 4.5 | claude-haiku-4-5 | 200K / 64K | 最快最便宜,步骤清楚的批量活专用。 |
2026-09-01 补充:上表写于 8 月。此后 Anthropic 发布了 Claude Fable 5.1,接替 Fable 5 成为当前旗舰(Fable 5 已被移进官方的 Legacy 列表),所以表里「上限最高」那一格现在应该读作 Fable 5.1。但官方对大多数场景的建议没变,仍是从 Opus 5 起步,本文其余内容不受影响。要不要换、换前要改什么,见Fable 5.1 那篇。
有个容易被漏掉的点:Opus 5 的可靠知识截止是 2026 年 5 月,是这四款里最新的。这对龙虾有实际影响——你让它写脚本、调库、查某个工具的用法时,它脑子里那份「世界长什么样」的快照更新一些,少几次一本正经地用过时 API 的机会。
另一个方向的区别是思考模式。Opus 5 是 adaptive thinking,而且默认就开着。Opus 4.8 和 4.7 也支持 adaptive,但默认是关的;你不写 thinking 字段,它就不思考。同样一段代码从 4.8 换成 Opus 5,什么都不改,行为已经变了:模型开始思考,思考的 token 算进 max_tokens,响应变慢、单次变贵。这不是 bug,是默认值换了。
价格:和 4.8 同价,是 Fable 5 的一半
直接看数字(每百万 token,截至 2026-08-23,以 官方定价页为准):
| 模型 | 输入 | 输出 |
|---|---|---|
| Claude Fable 5 | $10 | $50 |
| Claude Opus 5 | $5 | $25 |
| Claude Opus 4.8 | $5 | $25 |
| Claude Sonnet 5 | $2(introductory 价) | $10(introductory 价) |
| Claude Haiku 4.5 | $1 | $5 |
Sonnet 5 那一行要留个心眼:$2 / $10 是 introductory 价,官方标注的有效期到 2026-08-31,之后回到 $3 / $15。你要是照着 $2 排预算,九月账单会跳一下。
Opus 5 和 Opus 4.8 同价这件事,基本决定了迁移的性价比:一样的钱,换更新的模型和更新的知识截止。真正让人犹豫的不是钱,是下面那几个会报错的老写法。
接到龙虾上,改的其实就一行
OpenClaw 本体不挑大脑,它只要一个能对话、能调工具的接口。所以接 Opus 5 的动作很小,分两处:密钥放环境变量,模型名写配置文件。
先在 .env 里放密钥。注意 OpenClaw 的密钥是按服务商分开命名的,不是一个通用的 API_KEY:
ANTHROPIC_API_KEY=sk-ant-你的密钥
再到 ~/.openclaw/openclaw.json 里指定模型。模型引用是 服务商/模型名 的格式:
{
agents: {
defaults: {
model: {
primary: "anthropic/claude-opus-5"
}
}
}
}
写在 agents.defaults.model.primary 下面。同级还有 fallbacks,可以填备用模型,主模型不可用时自动顶上——跑长任务的话建议配一个。
🔴 这里要提醒一句:网上(包括本站早期几篇文章)流传过 MODEL_PROVIDER=anthropic / MODEL_NAME=... 这种写法,在当前版本的 OpenClaw 里是不存在的字段,照抄不会生效。以 官方仓库的 .env.example 和配置文档为准;项目迭代快,动手前值得再对一眼。
填完先跑一条最小任务确认通了,再去动参数。一上来就把 effort、task budget、fast mode 全配上,出错了你不知道是哪一层的问题。
从 Opus 4.8 搬过来,这三种写法会直接 400
如果你的龙虾配置是从 Opus 4.7 / 4.8 时代抄来的,大概率会踩到下面这三条中的至少一条。官方迁移指南把它们列得很清楚。
1. budget_tokens 那套老写法
thinking: {"type": "enabled", "budget_tokens": N} 是 extended thinking 的手动写法。Claude 4.7 及之后的模型不再支持它,请求直接 400,错误信息大意是「这个模型不支持 thinking.type.enabled,请改用 adaptive 加 output_config.effort」。注意这条不是 Opus 5 新加的限制,Opus 4.8 也一样拒绝——但很多人从更老的版本一路抄配置过来,到这一步才第一次撞上。
2. assistant prefill
给助手消息预填一个开头来逼它按格式输出,这招在 Opus 5 上返回 400,和 Opus 4.8 一样。想控制输出格式,改用系统提示,或者用 structured outputs 让它吐结构化结果。
3. 关掉 thinking 再配高 effort
这条才是 Opus 5 真正新增的。thinking: {"type": "disabled"} 在 Opus 5 上只有在 effort 为 high 或更低时才被接受,配上 xhigh 或 max 就是 400。也就是说:
# Opus 4.8 上能跑
client.messages.create(
model="claude-opus-4-8",
max_tokens=16000,
thinking={"type": "disabled"},
output_config={"effort": "xhigh"}, # 4.8 接受
messages=[...],
)
# 同样的参数换成 Opus 5 → 400
# 两条出路:要么把 thinking 交回默认(开着),要么把 effort 降到 high 及以下
多说一句:就算你的 effort 停在 high、关 thinking 合法,也不建议关。官方排错文档把「工具调用被写进可见文本」列成 Opus 5 关掉 thinking 后的已知症状,尤其在工具密集的活上(比如搜索)。漏出来的那条工具调用不会真的执行、也不报错,而在智能体循环里,这段文本还会留在对话历史里继续影响后面几轮。伴随的还有 <thinking> 这类内部标签漏进可见输出。想省 token,降 effort 才是正路。
effort 五档:别把 4.7/4.8 的设置照搬过来
Opus 5 的思考深度靠 output_config.effort 控制,五档:low / medium / high / xhigh / max,API 默认 high。写法很朴素:
{
"model": "claude-opus-5",
"max_tokens": 4096,
"output_config": { "effort": "medium" },
"messages": [ ... ]
}
这里有个坑值得单拎出来。Opus 4.7 和 4.8 的官方建议是「编码和智能体场景从 xhigh 起步」,不少人的龙虾配置就这么写着。但官方对 Opus 5 的建议不一样:从默认的 high 起步,跑你自己的任务看效果,难的编码和智能体活再升 xhigh,值得砸钱的才上 max;质量扛得住的地方,放心用 low 和 medium 当主要的成本闸。文档里还专门提醒:从旧模型带过来的 effort 设置,应该重新扫一遍,别直接复用。
| 档位 | 官方定位 | 龙虾场景里怎么用 |
|---|---|---|
| low | 最省,能力有折损 | 分类、抓取、格式转换这类步骤明确的活;子代理也适合 |
| medium | 速度成本性能的平衡点 | 日常杂活的默认降档位置 |
| high | 默认值,等同于不写这个参数 | Opus 5 的建议起点 |
| xhigh | 长程工作的扩展档 | 跑半小时以上、反复调工具的长任务 |
| max | 不设上限的最强档 | 真正的硬骨头,平时别开 |
三个实操细节:
- effort 管的是思考量,不是回复长度。官方明说,在 Opus 5 上调 effort 并不能稳定地把回复变短。嫌它啰嗦就在提示词里要求长度,别指望降档解决。
- 一个会话里别来回改 effort——除非你带上那个 beta 头。默认情况下 effort 的值参与渲染提示词,改了就对不上之前缓存的前缀,prompt 缓存直接失效,所以要分层就按任务类型分。但 2026-09-01 起有了例外:带上
mid-conversation-output-config-2026-07-01这个 beta 头之后,Opus 5(以及 Fable 5.1)支持在会话中途改 effort 且不会让缓存失效——难的步骤调高、日常步骤调低。细节见Fable 5.1 那篇。thinking 配置改动仍然照旧,会失效。 - 开
xhigh或max时把max_tokens开大,官方给的起点是 64K。因为思考 token 也算进max_tokens,开小了会出现思考还没完就被砍断、stop_reason返回max_tokens的情况。另外max_tokens开得很大时用 streaming,否则容易撞 HTTP 超时。
顺带一提,如果你在龙虾日志里看到 thinking 块是空的、只剩签名,那不是坏了——新模型上 thinking 的 display 默认就是 omitted,想看摘要得显式设成 summarized。
成本心算:一个假设算例
公式没什么玄机:单次任务成本 ≈ 输入 token × 输入单价 + 输出 token × 输出单价。难的是估 token 数。智能体的特点是输入远大于输出——每转一圈,之前的历史和工具返回都要重新塞进上下文,所以任务越长,每步的输入越滚越大。
下面这组用量纯属假设,只为演示怎么算,不是实测数据。假设一次中等任务累计输入 20 万 token、输出 2 万 token:
- Haiku 4.5:0.2M × $1 + 0.02M × $5 = 约 $0.30
- Sonnet 5(按 $2 / $10 的 introductory 价):0.2M × $2 + 0.02M × $10 = 约 $0.60
- Opus 5:0.2M × $5 + 0.02M × $25 = 约 $1.50
- Fable 5:0.2M × $10 + 0.02M × $50 = 约 $3.00
单次看都不贵,乘上「每天几十次 × 三十天」就不是一回事了。你的真实用量,跑几趟任务后在控制台的用量页一看便知,拿实际数字套公式就行。要注意 Opus 5 默认开思考,思考 token 算在输出里——同一条任务从 4.8 换过来,输出那一栏会比你记忆中的数字大。
省钱的顺序建议是这样的:先降 effort,再考虑换模型,最后才是碰 thinking 开关(前面说过,关它有副作用)。分层路由也依然成立:轻活交给 Haiku 或 Sonnet 5,跑砸了再升 Opus 5 重试,龙虾换大脑不过是换配置。各模型在龙虾场景的口径对比,我们在 AI 模型榜和哪个模型当龙虾大脑更合适里另有整理;想看它和 GPT 一侧怎么比,可以对着GPT-5.6 的三档选型看。
还有一个专门给智能体准备的开关叫 task budget(beta,要带 task-budgets-2026-03-13 头)。它给整个循环一个 token 预算,模型能看见剩余额度的倒计时,自己收着点跑、快用完时体面收尾——和 max_tokens 那种一刀砍断不一样。最小值 20000,低于这个数直接 400。两个提醒:它是软提示不是硬闸,该配的 max_tokens 还得配;预算给太小反而会让模型觉得干不完,干脆缩小范围或者提前收工。
要泼的冷水也泼一下
几件用之前最好先知道的事:
- Fast mode 大多数人用不上。它确实是 Opus 5 和 Opus 4.8 才有的东西,输出速度最高 2.5 倍,但目前是 research preview,要联系客户经理或者排队申请,不是填个 flag 就能开。而且价格直接涨到 $10 / $50——和 Fable 5 同价,买的只是速度不是智商。官方文档也写明它只在 Claude API 和 Managed Agents 上有,Bedrock、Google Cloud、Microsoft Foundry 都没有,还有独立的限流额度和独立的 429。
- Priority Tier 别指望。官方已经停售容量承诺,而且即便手上有老合约,支持范围里也明确排除了 Opus 5 和 Sonnet 5。以为买了就能全模型保底的,得改预期。
- 它跑不了本地。Opus 5 是闭源云端模型,数据必须发到服务商那边。在意隐私、或者想断网也能用的,这条路本来就不通,该看的是本地模型那一支。
- 轻活别拿它跑。归类、改格式、抓个页面,用 Opus 5 是拿高射炮打蚊子。这类活给 Haiku 4.5 或 Sonnet 5,省下来的钱够你多跑十倍任务。
- 换模型不是万灵药。龙虾任务失败,很多时候是工具没配好、权限不够、提示词太含糊,换个更贵的大脑照样失败。先按工具调用失败排查那套顺序过一遍,再考虑升档。
最后重复一遍时效声明:上面所有价格、beta 标记和支持范围,都是 2026-08-23 从官方文档核的。这块变得比谁都快,动手前请自己再对一眼官方页面。
常见问题
- Opus 5 比 Opus 4.8 贵吗?
- 不贵,两者同价,都是每百万 token 输入 $5、输出 $25。差别在别处:Opus 5 的知识截止更新(2026 年 5 月),而且思考默认开着,同一条任务的输出 token 会比 4.8 多一些,实际账单可能因此上浮。价格以官方定价页为准。
- 龙虾接 Opus 5 一个月要花多少钱?
- 没法给你一个准数,这完全取决于你每天跑多少任务、任务有多长。可以自己心算:单次成本约等于输入 token × $5/百万 + 输出 token × $25/百万。跑几趟真实任务,在控制台用量页看实际 token 数,再乘以你的频次,比任何估算都靠谱。
- 从 Opus 4.8 换成 Opus 5,配置要改什么?
- 模型名改成 claude-opus-5 是第一步。然后检查三处:有没有用 thinking 的 budget_tokens 老写法(400)、有没有给助手消息做 prefill(400)、有没有在关掉 thinking 的同时把 effort 设成 xhigh 或 max(Opus 5 上是 400)。另外 effort 建议重新调一遍,别直接复用 4.8 的档位。
- effort 该设成哪一档?
- 官方对 Opus 5 的建议是从默认的 high 起步,再按自己的任务往上或往下调。难的编码和长程智能体活升到 xhigh,常规杂活降到 medium 甚至 low 省钱。默认情况下别在同一段会话里来回改,那会让 prompt 缓存失效;但带上 mid-conversation-output-config-2026-07-01 这个 beta 头之后就可以中途改而不失效,Opus 5 也在支持之列。
- 想省钱,能把 thinking 关掉吗?
- 技术上可以(effort 在 high 及以下时才被接受),但不建议。官方排错文档记录了关掉之后的已知症状:模型偶尔把工具调用写进可见文本,那条调用不会真执行也不报错,还会留在对话历史里影响后面几轮;也可能把内部的 thinking 标签漏进可见输出。省钱应该先降 effort。
- Fast mode 值得开吗?
- 对绝大多数个人用户来说没得开——它还是 research preview,要申请或排队,不是加个参数就行。就算开到了,价格会涨到 $10 / $50,买的只是输出速度(最高 2.5 倍),模型本身的能力不变。而且 Bedrock、Google Cloud、Microsoft Foundry 上都没有。