OPUS 5 · 主力机把已知的事做对
硬编码任务的工作马:多文件特性、大重构、端到端排查。越难差距越明显,简单单轮编辑上反而拉不开差距。代码审查精度与召回都高,而且低 effort 下依然准——所以「便宜的快速 review + 贵的深度 review」这种两段式是成立的。视觉任务里,给它裁剪 / 分析工具比拉高思考更划算。
日常默认 · 九成的活儿模型、effort、fast 是三个独立旋钮,不是同一条「更强」的滑杆。这份手册只回答一件事:面对你手上这堆活儿——Akke 的 47 个 cron、Softie 的计费与 SEO、CozyUp 的支付合规、视频流水线选型——该拧哪一个、拧到几档。
// 基于 Claude Code 2.1.220 实测口径 · 你当前默认 opus[1m]
最常见的浪费不是「选错模型」,是用错旋钮解决问题——嫌它啰嗦去降 effort、嫌它慢去换 Fable、想让它更聪明去开 fast。这三件事互不相干。
Fable 5 / Opus 5 / Sonnet 5 / Haiku
决定能力天花板与单 token 单价。换模型解决的是「它想不明白」,不是「它太慢」或「它太啰嗦」。
low · medium · high · xhigh · max · auto
决定同一个脑子想多深、动多少手。它同时是最有效的省钱杠杆——降一档常常质量不掉、token 掉一半。
仅 Opus 系(Fable 不支持)
同一个模型、同样的智力,只是输出更快,按溢价计费。它不会让答案更好,只让你更早看到答案。
「想不明白」→ 换模型。「想得不够深 / 想太多」→ 调 effort。「等得烦」→ 开 fast。啰嗦、跑题、过度验证——三个旋钮都治不了,那是 prompt 的事。
Fable 5 是目前最强的广泛发布模型,Opus 5 是复杂工程的主力机。但差价不止牌面上的 2 倍——Fable 单轮更长、token 更多,实际账单往往落在 Opus 的三到四倍。
| 维度 | Claude Opus 5 | Claude Fable 5 |
|---|---|---|
| 定价(每百万 token) | $5 输入 / $25 输出 | $10 输入 / $50 输出 |
| 实际账单倍数 | 基准 1× | 约 3~4×(单价 2× × 轮次更长) |
| 上下文 / 最大输出 | 1M / 128K | 1M / 128K |
| 思考(thinking) | 默认开,effort ≤ high 时可关 | 永远开,关不掉 |
| Effort 档位 | low → max(默认 high) | low → max(默认 high) |
| 单轮时长 | 常规 | 硬任务十几分钟一轮是正常的 |
| /fast 加速 | 支持 | 不支持 |
| 安全分类器 | 有 | 有,且对网络安全 / 研究生物学更容易拒答 |
| 数据留存前提 | 无特殊要求 | 需 30 天留存,零留存组织不可用 |
硬编码任务的工作马:多文件特性、大重构、端到端排查。越难差距越明显,简单单轮编辑上反而拉不开差距。代码审查精度与召回都高,而且低 effort 下依然准——所以「便宜的快速 review + 贵的深度 review」这种两段式是成立的。视觉任务里,给它裁剪 / 分析工具比拉高思考更划算。
日常默认 · 九成的活儿长时程自主运行、在模糊需求里导航、规格明确的系统一次成型、端到端交付物(财务分析、表格、幻灯片、文档)、仓库历史检索、密集 / 劣化图像理解,以及并行子 agent 的委派与持续通信。它的低 effort 表现常常已经超过上一代模型的 xhigh。
攻坚 · 值钱的那一成Fable 5 的 bug 发现增益不覆盖安全向分析,而且它对网络安全内容的分类器更容易触发拒答。你的反爬绕过、IP 风控、企微 / 抖音风控状态机、渗透式排查这一类活儿要用 Opus 5——不是因为 Fable 弱,是因为它会在这里停下来。
别按「重要程度」选模型,按不确定性的位置选。先问一句:这活儿卡在「我知道要做什么,需要它做对」,还是卡在「我不确定要做什么,需要它替我想明白」?
// 反模式:把 Fable 当「更好用的 Opus」全天挂着。它的优势在长时程与模糊性,而你八成的会话既不长也不模糊。
Opus 5 的 low / medium 强得不合常理——很多活儿降一档质量不掉、token 掉一半。反过来,编码与 agentic 任务的甜点在 xhigh,而 max 容易钻牛角尖,不该当默认。
| 档位 | 什么时候用 | 在你这儿的典型活儿 |
|---|---|---|
| low | 短、明确、不需要判断力 | 改一行配置、批量重命名、跑命令看输出、格式化、读日志找关键行 |
| medium | 常规实现与排查 (主要省钱档) | 写一个 cron handler、加一个 Base 字段、拼 Lark 卡片 JSON、周报跑批 |
| high | 默认档,需要判断的活 | 生产问题定位、PR 评审、写 learn 长页、方案对比 |
| xhigh | 编码 / agentic 的最优点 | 跨模块重构、长链路调试、执行 implementation plan、安全审计 |
| max | 正确性 > 成本,且愿意等 | 支付 / 鉴权这种改错就出事的路径;会 overthink,别常开 |
| auto | 不想管,让它自己挑 | 杂活会话、探索性提问 |
| ultracode | xhigh + 常驻多 agent 编排 | 全面审计 / 大范围迁移;token 成本量级上跳,按次开 |
先给足,再往下扫。编码类从 xhigh 起步,其它从 high 起步,然后在你自己的活儿上往下试一档——质量不掉就留在低档。从上一代模型继承来的 effort 习惯基本都不适用于现在这两个模型,值得重扫一遍。
嫌输出啰嗦时降 effort 没用——Opus 5 的话痨要用 prompt 压(「先给结论、保持简洁」)。effort 管的是想多深,不是说多少。
按你最近在跑的几条线,把上面的判定线换算成可以直接照抄的档位。
有心跳、有 Langfuse trace、有 delta 指标——证据齐全的定位型问题。这是 Opus 的主场,Fable 在这里只是更贵。
Opus 5 · highPR #77–80 那一类:金额改服务端定价、webhook fail-closed、直登接管。改错就出事,且属安全向分析——Fable 的增益不覆盖这里。
Opus 5 · xhigh~max多来源证据、成本模型、要出一份能直接给人看的结论文档。模糊 + 端到端交付物 = Fable 的定义域。
Fable 5 · high每周照模板跑批,Opus medium 足够。要新设计一版报表结构、重排指标口径时才值得上 Fable。
Opus 5 · medium骨架、配色、动效都已在 skill 里定死,属照规格实现。换 Fable 不会更好看,只会更慢。
Opus 5 · high规格明确但体量大——Fable 的一次成型优势在这里最值钱。首轮把完整规格给足,然后让它跑长。
Fable 5 · xhigh改 FILES 数组、加日志、同步 route 表——纯执行,没有判断。low 档跑完,省下的额度留给硬活。
Opus 5 · lowADB 状态机、f2 签名回退、住宅 IP 评分——红线区。Fable 会拒答且没有兜底,直接留在 Opus。
Opus 5 · highFable 能与长跑子 agent 持续通信,是它的强项;但成本随 agent 数量翻倍,只在结论真值钱时开 ultracode。
Fable 5 · ultracode(按次)这几条不是理论——是这一代模型的行为变化直接导致的,沿用旧习惯反而更慢更贵。
拒答在 Claude Code 里没有自动兜底。API 上可以配 fallback,让被拒的请求自动改投 Opus;CC 里不会——它就停在那儿。所以安全向的活儿从一开始就别交给 Fable。
| 命令 | 作用 | 备注 |
|---|---|---|
| /model | 切模型 | Fable 最难的问题 · Opus 复杂工作 · Sonnet 多数任务 · Haiku 快问快答 |
| /effort high | 切本会话思考深度 | 可选 low / medium / high / xhigh / max / auto / ultracode |
| /effort | 不带参数 | 交互式选择;选过的值会存成新会话默认 |
| /fast | 切换 fast 模式 | 同模型、更快输出、按溢价计费;Fable 不支持 |
| settings.json | 持久默认 | 你当前是 "model": "opus[1m]",effort 未设 = 走 high |
Opus 5 + high;写代码 / 重构时手动抬到 xhigh;机械批改降到 low。这一套覆盖你绝大部分日常。
满足任意两条再切:需求说不清、要无人值守跑很久、要一次产出可交付文档、Opus 已经绕了两轮。且不在安全向红线内。