O Claude Code tem quatro controles para ajustar velocidade, qualidade e custo: /model, /effort, /fast e /advisor.
As funções dos quatro são sutilmente diferentes, por isso é fácil confundi-los. Nesta edição, vamos organizar tudo de uma vez.
Se Claude Code, parte 7 tratava de aumentar o número de trabalhadores, esta edição mostra como ajustar o desempenho de cada um.
/model: qual modelo fará o trabalho
/model altera o modelo principal da sessão. Usar um alias em vez do número da versão é mais prático.
Os principais aliases de Documentação oficial de configuração de modelos são estes.
fable: o modelo topo de linha para as tarefas mais difíceis e demoradasopus: para tarefas de raciocínio complexosonnet: para tarefas cotidianas de programaçãohaiku: modelo leve para tarefas simplesdefault: remove a substituição e retorna ao valor recomendado para a conta
Digite apenas /model para abrir o seletor. Pressione Enter para salvar a seleção como padrão ou s para aplicá-la somente à sessão atual.
Se você trocar o modelo depois que a conversa começar, a próxima resposta relê todo o histórico sem usar o cache. Por isso, o seletor pede confirmação uma vez.
/effort: quão profundamente pensar
/effort define a intensidade do raciocínio adaptativo do modelo. Quanto menor, mais rápido e barato; quanto maior, mais profundo.
Há cinco níveis: low, medium, high, xhigh e max. Os níveis compatíveis variam por modelo, e o Haiku não oferece suporte a effort.
Ao definir um nível incompatível, ele recua para o nível compatível mais alto abaixo dele.
O padrão é high na maioria dos modelos. max oferece o raciocínio mais profundo, mas vale apenas para a sessão atual.
O menu também inclui ultracode. É uma configuração do Claude Code que envia xhigh ao modelo e executa junto um fluxo de trabalho multiagente para tarefas grandes. Também fica limitado à sessão.
/fast: execute o mesmo modelo mais rapidamente
/fast é um botão que executa o Opus até 2,5 vezes mais rápido (prévia de pesquisa).
O importante é que o modelo não muda. Como Documentação oficial do fast mode explica, o mesmo Opus roda em uma configuração que prioriza velocidade; a qualidade permanece igual, mas o preço por token aumenta.
- Modelos compatíveis: Opus 5 e Opus 4.8 (Sonnet e Haiku não são compatíveis; se ativado em outro modelo, muda automaticamente para Opus)
- Preço: com base em Documentação oficial do fast mode, entrada $10 · saída $50 (por milhão de tokens)
- Os planos de assinatura (Pro·Max·Team·Enterprise) exigem a ativação de créditos de uso (Team·Enterprise também exigem ativação pelo administrador)
Existe uma armadilha de custo. Se você ativar no meio da conversa, todo o contexto acumulado até aquele momento será reprocessado uma vez pela tarifa do modo fast. Se for usar, é mais barato ativar desde o início da sessão.
Enquanto estiver ativado, um ícone ↯ aparece ao lado do campo de entrada.
/advisor: use um modelo avançado apenas nos momentos decisivos
/advisor é um Recurso experimental que adiciona um consultor ao modelo principal.
Antes de definir uma direção, quando o mesmo erro se repete ou antes de declarar a conclusão, o Claude consulta automaticamente um modelo mais forte nesses momentos decisivos. O modelo consultor recebe toda a conversa e retorna uma orientação.
/advisor opus
Há uma regra: o consultor não pode ser mais fraco que o modelo principal. Sonnet como principal e Opus como consultor é uma combinação típica; um modelo principal Fable só recebe consultoria do Fable.
Na cobrança por API, aplica-se a tarifa do modelo consultor; em planos de assinatura, o custo sai do uso do plano. Ainda assim, como ele é chamado apenas em pontos de decisão, e não a cada turno, geralmente custa menos que manter um modelo forte rodando o tempo todo.
Combinações recomendadas por situação
- Programação cotidiana: sonnet + effort padrão. Se necessário, adicione opus pelo advisor
- Design difícil·trabalho autônomo longo: fable ou opus + high ou superior
- Correções iterativas urgentes·depuração ao vivo: modo fast + effort baixo
- Tarefas simples em lote: haiku (não oferece suporte a effort, então use-o como está)
Resumo
/model define quem trabalha, /effort quão profundamente pensar, /fast quão rápido responder e /advisor quando consultar um modelo avançado.
Os quatro são controles independentes, então podem ser combinados livremente. Ajuste-os conforme a natureza da tarefa.
Na próxima edição, vamos abordar /code-review, que ajuda a preservar a qualidade do código. Vou resumir as diferenças entre os níveis de revisão, de low a ultra.
Fontes e critérios de verificação
- Documentação oficial do Claude Code — Model configuration (Anthropic, verificado em 2026-08-14)
- Documentação oficial do Claude Code — Fast mode (Anthropic, verificado em 2026-08-14)
- Documentação oficial do Claude Code — Advisor tool (Anthropic, verificado em 2026-08-14)
Continue lendo
Série Claude Code
- Edição anterior: [Claude Code #2] /plan, modo de planejamento: alinhe o design antes de fazer alterações
- Edição anterior: [Claude Code #1] /init, comece gerando CLAUDE.md automaticamente

![Imagem de capa de [Claude Code #8] /model·/effort·/fast, ajuste de desempenho da IA](/assets/images/posts/14cb9846-dbec-4d11-ad84-fb58e3794cba/claude-code-model-effort-fast.jpg)