ARCHIVE · 27

Todos os artigos

Dos fundamentos aos critérios de decisão da prática profissional.

Programação e agentes de IA5 min de leitura

[Contexto de IA #7] Reduza o custo da API com cache de prompts

O último artigo da série é sobre dinheiro. Se você já executou um agente por API, provavelmente notou algo estranho na cobrança: os tokens de entrada custam muito mais que os de saída. Lembrando a estrutura do primeiro artigo, isso é esperado. A cada turno, todo o conteúdo, do prompt do sistema ao histórico completo, é enviado novamente; em uma sessão de 50 turnos, o mesmo prompt do sistema é cobrado 50 vezes…

Ler artigo
Programação e agentes de IA6 min de leitura

[Contexto de IA #6] Memória de agentes fora do contexto

Se você acompanhou a série até aqui, já deve ter percebido um padrão comum: minimizar o que fica dentro da janela de contexto. A Parte 3, “salvar o estado em um arquivo antes de /clear”; a Parte 4, “usar apenas ponteiros em vez do conteúdo”; e a Parte 5, “deixar o processo para os subagentes e enviar apenas as conclusões ao agente principal” apontam na mesma direção. Mas ainda não tratamos adequadamente do destino desses arquivos, ou seja, das informações enviadas para fora do contexto.

Ler artigo