一句话摘要
介绍 Fable 5 的努力度调节功能,避免为中低质量工作支付最高费用。
Fable 5 的 effort 拨盘:别再为平庸的工作付最高价 2026 年 7 月 5 日 · 阅读 7 分钟 · 查看源码 ↗ Claude Marketing
> 人人都在问,趁 Fable 5 在 7 月 7 日离开 Claude 应用之前,该拿它来构建什么。几乎没人在问那个决定你账单的问题:每个任务该买多少「思考」。
Fable 5 每 token 的价格大约是 Opus 4.8 的两倍,而且它聪明到会过度思考。如果留在默认设置,它会绕圈推理、反复检查自己的工作,在一个更便宜的模型一遍就能搞定的任务上白白烧 token。而且,由于 Claude Code 现在默认以 Fable 作为默认模型打开,大多数人正在为随意闲聊付双倍价格,却毫无察觉。
我知道这一点,是因为我审计了自己过去 10 周的 Claude Code 使用情况。数字很难看:我烧掉的 61% 是模型在重新读取上下文,只有 13% 是真正的输出。我的路由也是坏的。一个昂贵的模型承担了 72% 的成本,而最便宜档的 Haiku 在十周里只干了一美元左右的活。这篇指南就是我给自己写的补救方案。
我在「7 builds」指南里讲过该拿它构建什么。这是缺失的另一半:如何在不烧穿你每周额度的情况下运行那些构建,以及如何在 7 日之后靠 API 活下去。
第 1 部分。拨盘
一个需要保存的方框。effort 是按任务设置的,不是按天:
LOW 聊天、草稿、摘要、日常编辑。
出人意料地能干,而且这已经
能在顶级设置下与 Opus 竞争。
MEDIUM 主力。真正的构建、综合、分析。
实际工作默认用这一档。
HIGH 只有挣来的升级才用:扛过
两次尝试的调试、架构决策。
XHIGH/MAX 烧最多的 token,却常常返回一个
更糟的答案:模型过度思考,
越过了正确答案。留给一扇单向门,
那些你无法重做的计划。
——「整篇指南浓缩成一张图。如果你只存一样东西,就存这个。」
在这里,更高不等于更聪明。这个刻度在顶端是弯曲的。而真正的漏洞,比选错档位更简单:大多数人根本从没碰过这个拨盘。
额外设置:Extended Thinking 默认关闭。为一个难题打开它,用完就关。如果永久开着,你连修个错别字都在付深度思考的价。
第 2 部分。路由规则
规则 1。Medium 是默认值,升级是挣来的
真正的活从 medium 开始,闲聊从 low 开始。只有当输出告诉你要升级时才升级:错了两次答案、结构缺失、推理太浅。凭证据升级只花几次重试。凭直觉把一切都跑在 max,会烧掉你的整个额度,而且过了某个点,它买到的反而是更糟的答案。
规则 2。Fable 规划,便宜模型执行,Fable 审查
一个高效项目的完整形态。构建者已经开始把这个拆分称作 10-80-10:
第一片:Fable 在高档设计工作。架构、成功标准、约束、可能出问题的地方。
中段主体:执行往下走台阶。Opus 4.8 做重推理的部分,Sonnet 做标准构建活,Haiku 做格式化和样板代码。
最后一片:Fable 回来对照自己的计划审查成品。审查很便宜,它读一个结果而不是生成一个结果,而这正是它能抓住便宜档漏掉之处的地方。
——「昂贵的大脑处理边角。中间部分属于便宜的模型。」
永远不要反过来。一个便宜的计划交给昂贵的模型去执行,是你能做的最差交易。
可粘贴版本,放进你的 CLAUDE.md:
## Model routing
Fable 5: plan, architect, review final output.
never mechanical work. effort: medium,
high for architecture only.
Opus 4.8: reasoning-heavy execution, complex debugging.
Sonnet: standard build work, refactors, features.
Haiku: formatting, boilerplate, grader subagents.
Rule: the expensive brain decides, the cheap hands type.
——「和上面同一张表,给那些往下滑的人。偷哪个版本都行。」
规则 3。子代理继承拨盘
生成一个子代理,它会复制你当前的模型和 effort。坐在 high 档时扇出十个 worker,你就付十倍的 high。在生成之前先把拨盘调低,而不是之后。
规则 4。不同模型抓不同的 bug
对于重要的审查,一个评委不够。让 Fable 做审查,然后把同样的材料交给一个对手模型做对抗性检查。实操版本:把成品 diff 或报告连同同一份清单和一条指令一起贴进 Codex 或 GPT:「攻击它,别总结它。」跨模型评判能抓住任何单一家族漏掉的东西。
规则 5。上下文就是钱
每一条消息都会重新发送对话尾部,所以一个长会话会悄悄地把每一次后续回复的价格乘上去。从我自己的审计看:五个马拉松会话在每一次调用上都挂着 330 到 528K token 的上下文,光这五个会话就占了我整个缓存账单的三分之二。十周里我用 /clear 的次数是零。用 /compact 是四次。
两个修复:
任务完成:/compact,或者开一个新窗口。
需要在别处继续:先要一个交接(handoff)。「写一个 500 token 以内的提示词,让这个会话在新聊天里重新开始:已做的决定、当前状态、下一步、约束。」把它贴进新窗口,用几分之一的成本继续。
并且要在一整条消息里喂给它完整的问题:完整上下文加上任务背后的为什么。更少的纠正轮次才是真正的省钱所在,因为每一次纠正都会给整个对话重新计费。
第 3 部分。API 生存包(7 月 7 日及之后)
切换之前的四个习惯:
每个会话开始时检查模型选择器。Fable 现在是默认值,而「不小心在随意闲聊上跑了 Fable」是最常见的泄漏。
加卡的那天就设一个硬性消费上限:设置,用量,调整限额。自主运行会在你睡觉时计费,一次整夜运行烧掉三位数账单的故事已经在流传了。
定期跑 /usage,直到你能凭感觉知道自己的燃烧速率。
把路由表留在 CLAUDE.md 里,让这个纪律熬过定价变化。
一次构建实际花多少
新测的,好让你能规划这一周。我以 medium effort 跑了「7 builds」指南里的会话审计构建。它生成了 4 个并行子代理,把一个会话从 47% 推到 90%,从我每周的 Fable 额度里扣掉了 9 个点。所以:一次 medium 档的真正构建,大约是每周 Fable 预算的十分之一,外加一个会话槽位。一天最多规划两次重型构建,这笔账就成立。
——「不是基准测试,是我实际的用量(Usage)屏幕。一次 medium 的审计构建:每周 Fable 额度的 9 个点。」
诚实的边界
上面的拨盘默认值是你应该自行调校的可用设置,而且内容类型很重要:代码审查对 low effort 的惩罚,比写草稿更狠。市面上流传的成本对比,包括「Fable low 胜过 Opus high」,来自创作者跑出的基准,而不是 Anthropic。各来源在方向上一致,但在你看到自己的账单之前,把确切的百分比当作营销话术。
一句话版本
> 决策买昂贵的思考,重复买便宜的思考,让昂贵的大脑回来检查结果,然后在每一次运行前看一眼拨盘。
该把这些指向哪里,在「7 builds」指南里。把这篇存在它旁边,它们是同一个系统的两半。
> 关注获取每日拆解。并回复你默认把拨盘放在哪一档,我很好奇人们实际在跑什么。标签:# X # Claude # Marketing # Guide # Fable # Sonnet 相关文章 How to Build an AI-Native Company: Hiring, Standards, and Cadence *We spent a year running hackathons, AI trainings, and office hours. But nothing changed until we made AI capability a requirement.* AI Loops Claude Marketing
原文参考:https://maxed.wiki/posts/the-fable-5-effort-dial-stop-paying-max-rates-for-medium-work/ (Maxed.wiki,本页为站内中文整理)