Programação e agentes de IA

[Claude Code #8] /model·/effort·/fast, ajuste de desempenho da IA

Reunimos os quatro controles de desempenho do Claude Code: aliases e regras de persistência do /model, níveis do /effort e ultracode, armadilhas de custo do /fast e combinações de modelos do /advisor, com recomendações para cada situação.

5 min de leitura
Imagem de capa de [Claude Code #8] /model·/effort·/fast, ajuste de desempenho da IA

O Claude Code tem quatro controles para ajustar velocidade, qualidade e custo: /model, /effort, /fast e /advisor.

As funções dos quatro são sutilmente diferentes, por isso é fácil confundi-los. Nesta edição, vamos organizar tudo de uma vez.

Se Claude Code, parte 7 tratava de aumentar o número de trabalhadores, esta edição mostra como ajustar o desempenho de cada um.

/model: qual modelo fará o trabalho

/model altera o modelo principal da sessão. Usar um alias em vez do número da versão é mais prático.

Os principais aliases de Documentação oficial de configuração de modelos são estes.

  • fable: o modelo topo de linha para as tarefas mais difíceis e demoradas
  • opus: para tarefas de raciocínio complexo
  • sonnet: para tarefas cotidianas de programação
  • haiku: modelo leve para tarefas simples
  • default: remove a substituição e retorna ao valor recomendado para a conta

Digite apenas /model para abrir o seletor. Pressione Enter para salvar a seleção como padrão ou s para aplicá-la somente à sessão atual.

Se você trocar o modelo depois que a conversa começar, a próxima resposta relê todo o histórico sem usar o cache. Por isso, o seletor pede confirmação uma vez.

/effort: quão profundamente pensar

/effort define a intensidade do raciocínio adaptativo do modelo. Quanto menor, mais rápido e barato; quanto maior, mais profundo.

Há cinco níveis: low, medium, high, xhigh e max. Os níveis compatíveis variam por modelo, e o Haiku não oferece suporte a effort.

Ao definir um nível incompatível, ele recua para o nível compatível mais alto abaixo dele.

O padrão é high na maioria dos modelos. max oferece o raciocínio mais profundo, mas vale apenas para a sessão atual.

O menu também inclui ultracode. É uma configuração do Claude Code que envia xhigh ao modelo e executa junto um fluxo de trabalho multiagente para tarefas grandes. Também fica limitado à sessão.

Diagrama para escolher model·effort·fast·advisor por tipo de tarefa no Claude Code
É mais fácil escolher começando pela natureza da tarefa

/fast: execute o mesmo modelo mais rapidamente

/fast é um botão que executa o Opus até 2,5 vezes mais rápido (prévia de pesquisa).

O importante é que o modelo não muda. Como Documentação oficial do fast mode explica, o mesmo Opus roda em uma configuração que prioriza velocidade; a qualidade permanece igual, mas o preço por token aumenta.

  • Modelos compatíveis: Opus 5 e Opus 4.8 (Sonnet e Haiku não são compatíveis; se ativado em outro modelo, muda automaticamente para Opus)
  • Preço: com base em Documentação oficial do fast mode, entrada $10 · saída $50 (por milhão de tokens)
  • Os planos de assinatura (Pro·Max·Team·Enterprise) exigem a ativação de créditos de uso (Team·Enterprise também exigem ativação pelo administrador)

Existe uma armadilha de custo. Se você ativar no meio da conversa, todo o contexto acumulado até aquele momento será reprocessado uma vez pela tarifa do modo fast. Se for usar, é mais barato ativar desde o início da sessão.

Enquanto estiver ativado, um ícone ↯ aparece ao lado do campo de entrada.

/advisor: use um modelo avançado apenas nos momentos decisivos

/advisor é um Recurso experimental que adiciona um consultor ao modelo principal.

Antes de definir uma direção, quando o mesmo erro se repete ou antes de declarar a conclusão, o Claude consulta automaticamente um modelo mais forte nesses momentos decisivos. O modelo consultor recebe toda a conversa e retorna uma orientação.

/advisor opus

Há uma regra: o consultor não pode ser mais fraco que o modelo principal. Sonnet como principal e Opus como consultor é uma combinação típica; um modelo principal Fable só recebe consultoria do Fable.

Na cobrança por API, aplica-se a tarifa do modelo consultor; em planos de assinatura, o custo sai do uso do plano. Ainda assim, como ele é chamado apenas em pontos de decisão, e não a cada turno, geralmente custa menos que manter um modelo forte rodando o tempo todo.

Combinações recomendadas por situação

  • Programação cotidiana: sonnet + effort padrão. Se necessário, adicione opus pelo advisor
  • Design difícil·trabalho autônomo longo: fable ou opus + high ou superior
  • Correções iterativas urgentes·depuração ao vivo: modo fast + effort baixo
  • Tarefas simples em lote: haiku (não oferece suporte a effort, então use-o como está)
Ilustração de um robô pequeno passando o bastão para um robô grande em uma bifurcação, com a frase ASK THE ADVISOR
Passe o bastão para um modelo avançado apenas nas bifurcações

Resumo

/model define quem trabalha, /effort quão profundamente pensar, /fast quão rápido responder e /advisor quando consultar um modelo avançado.

Os quatro são controles independentes, então podem ser combinados livremente. Ajuste-os conforme a natureza da tarefa.

Na próxima edição, vamos abordar /code-review, que ajuda a preservar a qualidade do código. Vou resumir as diferenças entre os níveis de revisão, de low a ultra.

Fontes e critérios de verificação

Continue lendo

Série Claude Code

Tópicos relacionados