Claude Code 有 4 个用于调节速度、质量和成本的控制项:/model、/effort、/fast、/advisor。
四者的作用略有不同,很容易混淆。本期一次讲清楚。
如果Claude Code 第 7 期讲的是如何增加工作者数量,那么本期讲的就是如何调节每个工作者的性能。
/model:由哪个模型执行工作
/model会更改会话的主模型。使用别名代替版本号更方便。
官方模型配置文档的主要别名如下。
fable:用于最困难、最耗时任务的顶级模型opus:用于复杂推理任务sonnet:用于日常编码任务haiku:用于简单任务的轻量模型default:清除覆盖设置,恢复为账户推荐值
只输入/model即可打开选择器。按 Enter 将选择保存为默认值,按 s 则仅应用于当前会话。
对话开始后更换模型,下一次响应会在不使用缓存的情况下重新读取完整记录。因此选择器会要求确认一次。
/effort:思考得有多深入
/effort用于设置模型的自适应推理强度。等级越低越快、越便宜,等级越高思考越深入。
共有 5 个等级:low、medium、high、xhigh、max。支持的等级因模型而异,Haiku 完全不支持 effort。
设置不支持的等级后,会降级到低于该等级的最高支持等级。
大多数模型的默认值是 high。max 提供最深入的推理,但仅应用于当前会话。
菜单中还包含 ultracode。这是 Claude Code 的一种配置:向模型发送 xhigh,并为大型任务同时运行多智能体工作流。同样仅限当前会话。
/fast:让同一个模型运行得更快
/fast是一个可让 Opus 运行速度最高提升 2.5 倍的开关(研究预览版)。
重点是模型并没有改变。正如官方 fast mode 文档所述,同一个 Opus 会以速度优先的配置运行,因此质量不变,只是每个 token 的价格更高。
- 支持的模型:Opus 5 和 Opus 4.8(不支持 Sonnet·Haiku;在其他模型上开启时会自动切换到 Opus)
- 价格:以官方 fast mode 文档为准,输入$10 · 输出$50(每百万 token)
- 订阅计划(Pro·Max·Team·Enterprise)需要启用用量额度(Team·Enterprise 还需要管理员启用)
这里有一个费用陷阱。如果在对话中途开启,系统会按 fast 模式价格,将截至当时的全部上下文重新处理一次。要使用它,从会话开始时就开启会更便宜。
开启期间,输入框旁会显示 ↯ 图标。
/advisor:只在关键时刻使用高级模型
/advisor是一个为主模型添加顾问的实验性功能。
在确定方向之前、同一个错误反复出现时,或宣布完成之前,Claude 会在这些关键时刻自动询问更强的模型。顾问模型会接收完整对话并返回建议。
/advisor opus
规则只有一条:顾问不能弱于主模型。主模型使用 Sonnet、顾问使用 Opus 是典型组合,而 Fable 作为主模型时只能接受 Fable 顾问。
按 API 计费时,顾问模型按自身费率计费;订阅计划则从计划用量中扣除。尽管如此,由于它只在决策点调用,而不是每轮调用,通常比持续运行强模型更便宜。
按场景推荐的组合
- 日常编码:sonnet + 默认 effort。需要时通过 advisor 添加 opus
- 困难设计·长时间自主工作:fable 或 opus + high 以上
- 紧急反复修改·实时调试:fast 模式 + 较低 effort
- 简单批处理任务:haiku(不支持 effort,因此直接使用)
总结
/model决定由谁工作,/effort决定思考深度,/fast决定回答速度,/advisor决定何时询问高级模型。
四者互不重叠,可以自由组合。请根据任务性质进行调整。
下一期将介绍用于保证代码质量的/code-review,并整理从 low 到 ultra 不同审查强度之间的差异。
来源与确认标准
- Claude Code 官方文档 — Model configuration(Anthropic,确认于 2026-08-14)
- Claude Code 官方文档 — Fast mode(Anthropic,确认于 2026-08-14)
- Claude Code 官方文档 — Advisor tool(Anthropic,确认于 2026-08-14)

![[Claude Code #8] /model·/effort·/fast,AI 性能调优 封面图](/assets/images/posts/14cb9846-dbec-4d11-ad84-fb58e3794cba/claude-code-model-effort-fast.jpg)