Claude Code 选型手册 · 内部口径

什么时候值得
换一台更贵的脑子

模型、effort、fast 是三个独立旋钮,不是同一条「更强」的滑杆。这份手册只回答一件事:面对你手上这堆活儿——Akke 的 47 个 cron、Softie 的计费与 SEO、CozyUp 的支付合规、视频流水线选型——该拧哪一个、拧到几档

// 基于 Claude Code 2.1.220 实测口径 · 你当前默认 opus[1m]

OPUS 5 · $5 / $25 FABLE 5 · $10 / $50 1M CONTEXT ×2 EFFORT LOW → MAX /FAST 仅 OPUS ULTRACODE = XHIGH + 编排
SCROLL / 向下滚动
01
Three Independent Knobs

三个旋钮 · 别拧错那一个

最常见的浪费不是「选错模型」,是用错旋钮解决问题——嫌它啰嗦去降 effort、嫌它慢去换 Fable、想让它更聪明去开 fast。这三件事互不相干。

Knob 1/model

换脑子

Fable 5 / Opus 5 / Sonnet 5 / Haiku

决定能力天花板与单 token 单价。换模型解决的是「它想不明白」,不是「它太慢」或「它太啰嗦」。

CC 自己的口径:Fable 最难的问题 · Opus 复杂工作
Knob 2/effort

调思考深度

low · medium · high · xhigh · max · auto

决定同一个脑子想多深、动多少手。它同时是最有效的省钱杠杆——降一档常常质量不掉、token 掉一半。

默认 high · 编码 / agentic 甜点在 xhigh
Knob 3/fast

加速吐字

仅 Opus 系(Fable 不支持)

同一个模型、同样的智力,只是输出更快,按溢价计费。它不会让答案更好,只让你更早看到答案。

Opus 5 fast 模式按 $10 / $50 计
口诀

「想不明白」→ 换模型。「想得不够深 / 想太多」→ 调 effort。「等得烦」→ 开 fast。啰嗦、跑题、过度验证——三个旋钮都治不了,那是 prompt 的事。

02
Opus 5 vs Fable 5

两台机器的真实差异

Fable 5 是目前最强的广泛发布模型,Opus 5 是复杂工程的主力机。但差价不止牌面上的 2 倍——Fable 单轮更长、token 更多,实际账单往往落在 Opus 的三到四倍。

维度Claude Opus 5Claude Fable 5
定价(每百万 token)$5 输入 / $25 输出$10 输入 / $50 输出
实际账单倍数基准 1×3~4×(单价 2× × 轮次更长)
上下文 / 最大输出1M / 128K1M / 128K
思考(thinking)默认开,effort ≤ high 时可关永远开,关不掉
Effort 档位low → max(默认 high)low → max(默认 high)
单轮时长常规硬任务十几分钟一轮是正常的
/fast 加速支持不支持
安全分类器有,且对网络安全 / 研究生物学更容易拒答
数据留存前提无特殊要求需 30 天留存,零留存组织不可用

OPUS 5 · 主力机把已知的事做对

硬编码任务的工作马:多文件特性、大重构、端到端排查。越难差距越明显,简单单轮编辑上反而拉不开差距。代码审查精度与召回都高,而且低 effort 下依然准——所以「便宜的快速 review + 贵的深度 review」这种两段式是成立的。视觉任务里,给它裁剪 / 分析工具比拉高思考更划算。

日常默认 · 九成的活儿

FABLE 5 · 攻坚机把没想清的事想清

长时程自主运行、在模糊需求里导航、规格明确的系统一次成型、端到端交付物(财务分析、表格、幻灯片、文档)、仓库历史检索、密集 / 劣化图像理解,以及并行子 agent 的委派与持续通信。它的低 effort 表现常常已经超过上一代模型的 xhigh。

攻坚 · 值钱的那一成
重要例外

Fable 5 的 bug 发现增益不覆盖安全向分析,而且它对网络安全内容的分类器更容易触发拒答。你的反爬绕过、IP 风控、企微 / 抖音风控状态机、渗透式排查这一类活儿要用 Opus 5——不是因为 Fable 弱,是因为它会在这里停下来。

03
The Decision Line

一句话判定:切不切 Fable

别按「重要程度」选模型,按不确定性的位置选。先问一句:这活儿卡在「我知道要做什么,需要它做对」,还是卡在「我不确定要做什么,需要它替我想明白」?

起点
问自己
需求说得清楚吗?说得清 → 走 Opus 线;说不清、要它替我把问题先定义出来 → 才考虑 Fable
分支 A
Opus 5
有明确症状、有可读证据(Langfuse trace / 日志 / diff / 报错)→ 这是定位与实现问题,Opus 5 就是最优解,effort 给到 high~xhigh
分支 B
Fable 5
要跨多源做判断、要一次性产出可交付文档、要它无人值守跑很久,或前两轮 Opus 已经在绕圈 → 换 Fable,并把完整任务规格一次给足
红线
留在 Opus
安全向分析、风控绕过、爬虫对抗——无论多难都别切:Fable 在这类话题上会拒答,而 Claude Code 里没有自动兜底
收尾
切回来
Fable 把方案想清楚之后,执行切回 Opus 5——照规格改代码是 Opus 的主场,也是账单的主场

// 反模式:把 Fable 当「更好用的 Opus」全天挂着。它的优势在长时程与模糊性,而你八成的会话既不长也不模糊。

04
Effort Ladder

Effort 阶梯 · 最被低估的杠杆

Opus 5 的 low / medium 强得不合常理——很多活儿降一档质量不掉、token 掉一半。反过来,编码与 agentic 任务的甜点在 xhigh,而 max 容易钻牛角尖,不该当默认。

档位什么时候用在你这儿的典型活儿
low短、明确、不需要判断力改一行配置、批量重命名、跑命令看输出、格式化、读日志找关键行
medium常规实现与排查
(主要省钱档)
写一个 cron handler、加一个 Base 字段、拼 Lark 卡片 JSON、周报跑批
high默认档,需要判断的活生产问题定位、PR 评审、写 learn 长页、方案对比
xhigh编码 / agentic 的最优点跨模块重构、长链路调试、执行 implementation plan、安全审计
max正确性 > 成本,且愿意等支付 / 鉴权这种改错就出事的路径;会 overthink,别常开
auto不想管,让它自己挑杂活会话、探索性提问
ultracodexhigh + 常驻多 agent 编排全面审计 / 大范围迁移;token 成本量级上跳,按次开
调法

先给足,再往下扫。编码类从 xhigh 起步,其它从 high 起步,然后在你自己的活儿上往下试一档——质量不掉就留在低档。从上一代模型继承来的 effort 习惯基本都不适用于现在这两个模型,值得重扫一遍。

别搞反

嫌输出啰嗦时降 effort 没用——Opus 5 的话痨要用 prompt 压(「先给结论、保持简洁」)。effort 管的是想多深,不是说多少。

05
Mapped to Your Actual Work

落到你手上的活儿

按你最近在跑的几条线,把上面的判定线换算成可以直接照抄的档位

AKKE · 47 CRONcron 静默失败排查

有心跳、有 Langfuse trace、有 delta 指标——证据齐全的定位型问题。这是 Opus 的主场,Fable 在这里只是更贵。

Opus 5 · high

COZYUP / SOFTIE支付与鉴权审计

PR #77–80 那一类:金额改服务端定价、webhook fail-closed、直登接管。改错就出事,且属安全向分析——Fable 的增益不覆盖这里。

Opus 5 · xhigh~max

视频流水线选型可灵 / 即梦 / 自建对比

多来源证据、成本模型、要出一份能直接给人看的结论文档。模糊 + 端到端交付物 = Fable 的定义域

Fable 5 · high

财务周报 / LARK 卡片结构化交付物

每周照模板跑批,Opus medium 足够。要新设计一版报表结构、重排指标口径时才值得上 Fable。

Opus 5 · medium

UPIO.AI / LEARN 长页照 skill 骨架产出

骨架、配色、动效都已在 skill 里定死,属照规格实现。换 Fable 不会更好看,只会更慢。

Opus 5 · high

从 0 到 1 的子系统ad-studio / TwinClub 那类

规格明确但体量大——Fable 的一次成型优势在这里最值钱。首轮把完整规格给足,然后让它跑长。

Fable 5 · xhigh

机械批改索引数组 / 批量替换

改 FILES 数组、加日志、同步 route 表——纯执行,没有判断。low 档跑完,省下的额度留给硬活。

Opus 5 · low

反爬 / 风控对抗抖音、企微、IP 风险

ADB 状态机、f2 签名回退、住宅 IP 评分——红线区。Fable 会拒答且没有兜底,直接留在 Opus。

Opus 5 · high

多 AGENT 编排全面审计 / 大范围迁移

Fable 能与长跑子 agent 持续通信,是它的强项;但成本随 agent 数量翻倍,只在结论真值钱时开 ultracode。

Fable 5 · ultracode(按次)
06
Traps That Cost Real Money

九个会真花钱的坑

这几条不是理论——是这一代模型的行为变化直接导致的,沿用旧习惯反而更慢更贵。

成本类

  • Fable 是乘法不是加法:单价 2×,叠加轮次更长,实际 3~4×。别默认挂着。
  • /fast 不提升智力:同一个模型、加价买速度,且只有 Opus 支持。急着看结果才开。
  • ultracode 会自己开工作流:xhigh 叠常驻编排,token 量级上跳,按次用、别设默认。

行为类

  • 删掉「再检查一遍」:Opus 5 自己会验证,写进 prompt 反而触发过度验证,纯烧 token。
  • 子 agent 要反向调:Opus 5 倾向多派,要给上限;Fable 5 反过来,值得鼓励它异步派。
  • 话痨用 prompt 压:调 effort 不管用,要明确说「先给结论、保持简洁」。

节奏类

  • Fable 一轮十几分钟是正常的,不是卡死。别中途打断重来。
  • 一次给足规格:Fable 最怕挤牙膏式多轮补充,首轮说清目标、约束、验收标准。
  • 想清楚后切回 Opus:方案定了就换回主力机执行,别用攻坚机干体力活。
最容易忽略的一条

拒答在 Claude Code 里没有自动兜底。API 上可以配 fallback,让被拒的请求自动改投 Opus;CC 里不会——它就停在那儿。所以安全向的活儿从一开始就别交给 Fable。

07
Cheat Sheet

速查 · 贴在手边的那一屏

命令作用备注
/model切模型Fable 最难的问题 · Opus 复杂工作 · Sonnet 多数任务 · Haiku 快问快答
/effort high切本会话思考深度可选 low / medium / high / xhigh / max / auto / ultracode
/effort不带参数交互式选择;选过的值会存成新会话默认
/fast切换 fast 模式同模型、更快输出、按溢价计费;Fable 不支持
settings.json持久默认你当前是 "model": "opus[1m]",effort 未设 = 走 high
A

默认姿势九成的会话

Opus 5 + high;写代码 / 重构时手动抬到 xhigh;机械批改降到 low。这一套覆盖你绝大部分日常。

B

升级信号什么时候才切 Fable

满足任意两条再切:需求说不清要无人值守跑很久要一次产出可交付文档Opus 已经绕了两轮。且不在安全向红线内。

一句话总括:Opus 5 是主力机,把已经想清楚的事做对;Fable 5 是攻坚机,把还没想清楚的事想清——但它慢、贵三四倍、在安全向话题上会停下来。真正天天该动的旋钮其实是 effort:编码 xhigh、日常 high、机械 low,比换模型省得多、也稳得多。