龙虾AI · OpenClaw 智能体生态导航 龙虾AI(OpenClaw)中文资料与下载导航
Anthropic 官方文档的 Claude Fable 5.1 页面,标着 Latest、model ID claude-fable-5-1,以及 1M 上下文、128K 输出、输入 $10、输出 $50
Anthropic 官方 Claude Fable 5.1 文档页,截图于 2026 年 9 月。本文的规格、价格与变更清单都出自这一页和它链出的「What's new」。以官方页面当时显示的为准。

新版 · 迁移

Claude Fable 5.1 发布:拿它给龙虾当大脑,到底值不值得换

Claude Fable 5.1 在 2026-09-01 发布,model ID 是 claude-fable-5-1,1M 上下文、128K 最大输出,输入输出价跟 Fable 5 一分没变:每百万 token 输入 $10、输出 $50。但最要紧的一句得放最前面——官方自己写着,大多数场景仍然应该从 Claude Opus 5 起步。这篇不劝你换,只讲三件事:这一版到底动了什么、你的龙虾值不值得跟、换之前必须先改掉哪几处会当场报 400 的写法。全文按 2026-09-01 的官方文档整理,链接放在文末,以你打开时官方页面显示的为准。

官方给它划的位置:Opus 5 顶不住的时候才上

先把定位摆正,后面所有取舍都从这里推。官方文档对 Fable 5.1 的用法说明只有两句:一句是它面向 demanding reasoning and long-horizon agentic work(吃推理、跑长程的智能体活),另一句更实用——当你在 Opus 5 上把 effort 调高之后,评测结果仍然不达标,再考虑换它。

这不是客套话,是价格逼出来的。Fable 5.1 是 $10 / $50,Opus 5 是 $5 / $25,整整两倍。同一条任务换过去,输入输出那两栏直接乘二,换来的也不是「哪儿都更好」,而是特定几类活上的上限更高。所以正确顺序是:先在 Opus 5 上升 effort,跑你自己的任务看结果,顶不住了才谈换模型。effort 怎么升,站内Opus 5 那篇写过五档怎么定。

基本盘:一张表看完

发布日2026-09-01
model IDclaude-fable-5-1
上下文 / 最大输出1M / 128K token
输入 / 输出价$10 / $50 每百万 token(与 Fable 5 完全相同)
思考adaptive,始终开启,深度用 effort 控制,默认 high
可靠知识截止2026 年 6 月
退役承诺不早于 2027-09-01
可用平台Claude API、Amazon Bedrock(anthropic.claude-fable-5-1)、Google Cloud、Microsoft Foundry、Claude Platform on AWS

几处值得单独说:

  • 思考始终开着,关不掉。和 Fable 5 一样,thinking: {"type": "disabled"} 直接 400,深度只能靠 effort 调,默认 high。这条不是孤立的,它牵出了下面那个「不能强制调工具」的变更。
  • 知识截止 2026 年 6 月。写脚本、调库、查某个工具用法时,它脑子里那份快照比 Opus 5(2026 年 5 月)新一个月。差一个月而已,别当卖点看。
  • 退役承诺不早于 2027-09-01。个人玩家对这个日期没什么感觉,但你要是把龙虾接进公司流程、把模型名写死在某条自动化里,至少知道一年之内不会被迫再迁一次。
  • 它还有个同规格的兄弟型号。Claude Mythos 5.1(claude-mythos-5-1)的能力、规格、价格与 Fable 5.1 相同,但只向 Project Glasswing 的参与者开放,得联系客户团队。普通人看看就行,别在配置里瞎填这个 ID。

价格表里唯一动了的一格:缓存读取

直接说结论:输入输出一分没涨,但缓存读取从基础输入价的 0.1× 降到了 0.025×。换成钱是每百万 token $0.25。

价格(每百万 token)
基础输入$10
输出$50
5 分钟缓存写入$12.50
1 小时缓存写入$20
缓存读取$0.25(= 基础输入价的 0.025×;其它 Claude 模型是 0.1×)
批处理$5 / $25

这一格对龙虾这种长会话智能体是真金白银。你的每一轮请求都在重发同一堆东西:系统提示、工具定义、之前的对话历史和工具返回。命中缓存的那部分,官方的说法是只付 Fable 5 的四分之一。任务转的圈越多、上下文拖得越长,这个折扣越明显。

但别高兴太早,有三个前提:

  • 缓存写入价没降,5 分钟档 $12.50、1 小时档 $20,仍然比基础输入价贵。
  • 最低可缓存长度还是 512 token,短前缀根本进不了缓存。
  • 命中的前提是前缀逐字不变。而 Fable 5.1 恰好在「什么算改动了前面」这件事上比以往严格得多——这就是下一节。

三条破坏性变更:从 Fable 5 搬过来会当场报错

1. 不能再强制它调工具了

tool_choice 设成 {"type":"any"}{"type":"tool","name":"..."},在 Fable 5.1 上返回 400 invalid_request_error,错误文案是 tool_choice: type "tool" and "any" are not supported for this model.auto(默认值)和 none 照旧能用。

原因跟上面那条「思考始终开着」是一根线上的:强制调工具会跳过思考,模型于是把推演过程写进工具参数里,参数质量反而更差。官方给了三条替代路——保持 auto,把工具改成 strict: true 的严格工具调用;或者改用 structured outputs 拿结构化结果;再或者干脆在提示词里写清楚什么情况下必须用哪个工具,官方说它对显式的工具指令遵循得可靠。

对龙虾用户的实际影响很具体:如果你在某个 skill 或自建管线里靠 tool_choice 逼它必须走某个工具,这行代码换模型之后当场炸。它属于换之前要先 grep 一遍的东西,不是跑起来慢慢发现的问题。

2. 思考块认模型,而且只能单向读

Fable 5.1 能读更早模型产生的思考块,更早的模型读不了它的。落到操作上:一段会话从 Opus 5 或 Fable 5 迁到 5.1,之前的推理保留;反过来切回去,那些轮次的推理就丢了。

丢法还挺安静。目标模型读不了的块,API 会直接丢弃,不计进 input_tokens、也不计费。想知道到底丢了什么,得带上 thinking-binding-controls-2026-08-01 这个 beta 头,丢弃动作会记在响应顶层的 input_transformations 数组里;不带就是静默丢。所以「先切过去试试,不行再切回来」这套 A/B 玩法在这里是有代价的,不是零成本回滚。

3. 改早前的轮次,会让后面的思考块全部失效

这条是三条里门槛最高的。改 system、改 tools、或者改早前的某条消息,下一次请求就会 400,文案里带 The block is bound to a different conversation

注意执行范围:对 2026-08-31 及之后创建的账号强制执行;更早的账号目前只记录不动作,除非你自己在请求里设了 thinking.block_binding.prefix_mismatch_behavior。换句话说,新注册的账号一上来就是严格模式。

会踩雷的动作:

  • 编辑、重排、删除中间某一轮消息。
  • 往早前的轮次里注入一段临时文本,用完再删掉。
  • 在同一段会话里重建 systemtools 数组(哪怕内容看着一模一样)。
  • 同一个 URL 在后续请求里返回了不同字节的图片或文档。

不会踩雷的动作:

  • 从最旧的开始,成段删掉开头的思考块。
  • 用服务端 compaction 或 context editing 裁历史。
  • cache_control 标记的位置。
  • 在请求之间改 effort

正解只有一句:把会话当作只能追加(append-only)。要加指令,用会话中的系统消息,别回头改 system;要换工具,用会话中的工具变更,别重建 tools 数组;要裁历史,交给服务端的 compaction 和 context editing,别自己动手删中间那几轮。

如果你只是在龙虾配置里填个模型名、消息数组由它自己管,这条大概率碰不到。自己拿 SDK 拼 messages、或者写过「重试时把上一轮改一改再发」这种逻辑的,得先把这套习惯改掉,再谈换模型。

新增的五项,挑龙虾用得上的说

前三项都要带 beta 头,头名列在这里,方便你去官方文档对着查。

  • 会话中途改 effort(mid-conversation-output-config-2026-07-01)。难的那一步调高、日常步骤调低,按官方说明不会让 prompt 缓存失效。Fable 5.1、Mythos 5.1、Opus 5 都支持。对龙虾这种一个任务里既有「读文件」又有「想方案」的循环,这是省钱空间最大的一项。
  • 只在当前这一轮生效的系统消息(mid-conversation-system-clear-at-2026-08-21)。在 role: "system" 的消息上设 clear_at: "next_user_message",它在当前这轮拥有系统提示的权限,等下一条 user 消息出现后就不再渲染。妙处在于消息本身还留在 messages 里原样回传:历史没变、缓存继续命中、后面的思考块也仍然有效,而且被清除之后不再计输入 token。想临时插一句「这一轮只准读不准写」,这是唯一不破坏前缀的做法。
  • 工具调用之间的可读进度更新(thinking-display-updates-2026-08-18)。把 thinking.display 设成 "updates",进度更新会以 thinking 块的形式出现在工具调用之前,是能读的文本状态行,同时真正的推理仍然隐藏。默认值是 "omitted",那些块回来是空的——这就是为什么跑长任务时日志安静得让人心慌。
  • 缓存读取降价,上一节已经算过账。
  • 内容溯源。Fable 5.1 生成的文本在所有平台都带 Anthropic 的统计式文本水印;通过 Files API 取回的图片和视频带签名的 C2PA Content Credentials。官方的说明是:水印不改变输出的含义、质量或可读性,不增加 token,不含隐藏字符,也不携带你或你所在组织的任何信息,请求和响应都不用改。

不改一行代码,你也会觉得它脾气变了

这一节是最容易被当成 bug 去排查、其实只是模型行为变了的部分。

第一件,也是对龙虾影响最大的一件:并行工具调用变得不稳定。Fable 5 会一次批量发几个工具调用的地方,5.1 可能一轮只发一个。官方明说这在长智能体循环里最明显——自定义编码 agent、bash 加编辑器的组合、computer use,全是龙虾的日常。多出来的轮次要费 token、费往返、费时间,但不降低答案质量;你在请求里明确点名要取好几样东西时,它仍然会并行。官方给的解法很朴素:在提示词里加一句,让它把互相独立的工具调用批量发出去。

其余几条按影响排:

  • 长任务期间的进度更新变少,effort 越高越明显。配合上面那个 thinking.display"updates" 一起用。
  • low effort 下更倾向于凭记忆作答,少去调检索和搜索工具。需要新鲜信息的那几轮,把 effort 调上去,别在这里图便宜。
  • 行文更密:句子更长、分段更少,聊天里用加粗、标题和列表也更少。让它写文档的人会最先察觉。
  • 总结文档时更容易不加引号地照抄原文,对引用规范有要求的,自己在提示词里补一条。
  • 改文件时更倾向整篇重写,而不是定点修改。结果通常一样,但输出 token 和时间都往上走。让它改配置、改代码的,这一条会直接反映在账单上。

要泼的冷水

  • 它比 Opus 5 贵一倍,这是最硬的一条。$10 / $50 对 $5 / $25。缓存读取那点折扣只作用在命中缓存的输入上,输出那一栏一分都省不了。
  • 并行退化可能把省下的钱吃回去。一次批量发三个工具调用,变成三轮各发一个,历史被重读三遍、往返三次。缓存能挡掉一部分输入成本,但多出来的输出 token 和延迟挡不掉。到底是省了还是亏了,只有拿你自己的任务跑一遍账才知道——别信任何人给你的通用结论,包括这篇。
  • append-only 那条,对自己拼 messages 的人是真门槛。它不是加个参数能绕过去的,是整套会话管理习惯要改,而且新账号强制执行。
  • 这次官方没有公布任何跑分数字。能力提升的方向倒是给了六个:长会话的智能体编码(多文件特性、大型重构与迁移、调试、跨会话代码审查)、文档表格幻灯片类知识工作、多步研究与搜索、读 PDF 里的密集图表和嵌套表格、在完整 1M 窗口里连点成线、还有 computer use(操作浏览器和桌面应用、从失败步骤里恢复)。方向明确,数字没有。所以这几天要是有人甩给你一张 Fable 5.1 的跑分对比图,先问一句出处。另外多语种表现,官方标的是与 Fable 5 持平,别指望中文任务上有额外惊喜。
  • 换模型不治工具没配好的病。龙虾任务跑砸了,多数时候是工具权限、路径、提示词含糊的问题,换个贵一倍的大脑照样砸。先按工具调用失败排查那套顺序过一遍再说升档。

那到底谁该换,换之前先做什么

你的情况建议为什么
Opus 5 已经升到 xhighmax,跑你自己的评测还是不达标这正是官方给 Fable 5.1 划的场景
长会话智能体编码,一个任务跨几十轮、反复重读同一段前缀值得试缓存读取只要四分之一,但要拿自己的账单验一遍
代码里靠 tool_choice 强制调工具先改代码不改就是 400,不是能力问题
自己拼 messages,而且会回头改历史先改习惯append-only 是硬要求,新账号强制执行
日常杂活、批量分类、格式转换别换贵一倍买不到对应的收益,这类活参考模型选型那篇往下降档
目标是省钱别换省钱的第一步是降 effort,不是升模型

决定换了,动手顺序建议这样走:

  • 先 grep 一遍配置和代码里的 tool_choice,把 any 和指定工具名的写法改成 autostrict: true,或者挪进提示词。
  • 再检查有没有「改早前轮次」的逻辑:重试时改写历史、临时注入再删、重建 tools 数组,有就改成只追加。
  • 模型名换成 claude-fable-5-1。在龙虾这边就是 ~/.openclaw/openclaw.jsonagents.defaults.model.primary 那一行,写法看接大脑那篇;只想给某一个 agent 换,可以按 agent 覆盖,方法在多 agent 那篇
  • 提示词里补一句「把互相独立的工具调用批量发出去」,对冲并行退化。
  • 跑三五条你真正常跑的任务,去控制台的用量页对账,和 Opus 5 的旧账单比一比,再决定留不留。

时效声明:上面所有价格、model ID、beta 头和限制,都是 2026-09-01 从 Anthropic 官方文档核的。这块变得比什么都快,动手前请自己再对一眼——Fable 5.1 模型总览Fable 5.1 有哪些变化官方定价页。跟本站写的对不上,以官方页面当时显示的为准。

常见问题

我该从 Opus 5 换过去吗?
多数人不该。官方文档自己写的是:大多数场景仍然应该从 Claude Opus 5 起步,Fable 5.1 留给吃推理、跑长程的智能体活,或者你在 Opus 5 上把 effort 调高之后评测仍然不达标的情况。顺序是先升 effort、跑自己的任务看结果,顶不住了再谈换模型。
贵一倍值不值?
得拿你自己的任务算。Fable 5.1 是每百万 token 输入 $10、输出 $50,Opus 5 是 $5 / $25,正好两倍。唯一变便宜的是缓存读取,从基础输入价的 0.1× 降到 0.025×,也就是 $0.25 每百万 token,官方的说法是长会话反复重读同一段缓存前缀只付 Fable 5 的四分之一。但输出那一栏一分不省,而且它的并行工具调用变差、轮次变多,省下的可能被吃回去。跑三五条真实任务对着控制台用量页算,比看任何结论都准。
换了要改代码吗?
有三处要先查。一是 tool_choice,设成 any 或指定工具名在 Fable 5.1 上返回 400,只有 auto 和 none 能用,替代做法是保持 auto 加严格工具调用、改用 structured outputs、或者在提示词里写清什么时候用哪个工具。二是会话管理要改成只追加,改 system、改 tools、改早前的消息都会让后面的思考块失效并报 400,这条对 2026-08-31 及之后创建的账号强制执行。三是从 Fable 5 迁过来的推理能保留,切回旧模型则会丢。只在龙虾配置里填模型名、不自己拼消息数组的人,基本只需要改第一处。
为什么换过去之后它一次只调一个工具了?
这是官方记录在案的行为变化,不是你配坏了。Fable 5 会一次批量发几个工具调用的地方,5.1 可能一轮只发一个,在长智能体循环里最明显,比如自定义编码 agent、bash 加编辑器的组合、computer use。官方说这会多花 token、多几次往返、多花时间,但不降低答案质量;请求里明确点名要取好几样东西时它仍然会并行。缓解办法是在提示词里加一句,让它把互相独立的工具调用批量发出去。
跑长任务时日志一片安静,是卡住了吗?
多半没卡。thinking.display 的默认值是 omitted,思考块回来是空的,加上 5.1 本身在长任务期间的进度更新就变少了,effort 越高越明显。想看得见,带上 thinking-display-updates-2026-08-18 这个 beta 头,把 thinking.display 设成 updates,进度更新会以 thinking 块的形式出现在工具调用之前,是能读的文本状态行,真正的推理仍然隐藏。
Claude Mythos 5.1 是什么,我能用吗?
大概率用不了。它的 model ID 是 claude-mythos-5-1,能力、规格、价格与 Fable 5.1 相同,但只向 Project Glasswing 的参与者开放,要联系客户团队才能拿到访问权。没有这层关系就别在配置里填这个 ID,填了也调不通。