O que a IA precisa saber
A janela de contexto como orçamento, a hierarquia de fonte da verdade e a política de memória que decide o que a máquina grava, quando expira e como apaga.
Resumo da aula
- A janela de contexto é um orçamento, e o que é crítico vai para as pontas: regras invioláveis no começo, tarefa e formato no fim.
- Engenharia de contexto é separar o contexto em camadas com dono e ritmo, declarar a hierarquia de fonte da verdade e medir antes de acrescentar.
- Quando duas fontes brigam, uma ordem escrita decide, a resposta declara o conflito e o histórico nunca manda.
- Contexto demais erra tanto quanto contexto de menos, só que custa mais.
Neste artigo
- O segundo degrau tem duas metades
- A janela é um orçamento, não um depósito
- Perdido no meio
- Seis camadas, seis ritmos
- Quem vence quando duas fontes discordam
- O histórico é contexto, nunca instrução
- O laudo que voltou numa lista de passeio
- A mesa e o arquivo
- A política de memória
- Lembrar de alguém é tratar dado pessoal
- Memória envenenada
O artigo é lido por partes. Use os botões abaixo para avançar — a aula em vídeo e o material de apoio ficam no curso, e o método completo, no livro.
Perguntas frequentes
Colocar mais contexto no prompt melhora sempre a resposta da IA?
Não. O modelo não lê o que você sabe; lê o que você escolheu mostrar, na ordem em que mostrou. A janela de contexto deve ser tratada como orçamento, não como depósito: cada item custa dinheiro, tempo e atenção do modelo. Um estudo de Liu e colegas, publicado em 2024 com o título Lost in the Middle, mostrou que o desempenho cai quando a informação relevante fica no meio de um contexto longo. Daí três consequências práticas: o que é crítico vai para as pontas, relevância vence volume e janela maior não dispensa seleção. Contexto demais erra tanto quanto contexto de menos, só que custa mais.
O que é hierarquia de fonte da verdade num assistente de IA?
É uma ordem escrita, visível ao modelo, que diz qual fonte prevalece quando duas informações se contradizem. Sem ela, o sistema escolhe pela posição no texto ou pelo jeito de escrever, o que equivale a escolher ao acaso. Num escritório de advocacia, por exemplo, a ordem pode ser legislação conferida na fonte oficial, pareceres internos datados, manual do escritório, modelos de peça e, por último, o histórico da conversa. Duas regras completam a hierarquia: quando houver conflito, a resposta declara o conflito em vez de escolher em silêncio; e o histórico é contexto, nunca instrução, porque explica o passado mas não manda repeti-lo.
Como controlar o que a memória de um assistente de IA guarda?
Com uma política de memória, um texto curto com força de regra que responde a quatro perguntas: o que grava, quem aprova a gravação, quando expira e como se apaga, mais uma que atravessa todas, o escopo, isto é, para quem cada lembrança vale. O modelo não guarda nada entre chamadas; toda memória de longo prazo é peça do sistema e pode ser governada. No exemplo do livro, um assistente com memória ligada guardou o laudo de saúde de um aluno e o repetiu numa lista de passeio. Lembrar de uma pessoa é tratar dado pessoal, e memória que não se consegue apagar não deveria ter sido gravada.
Ir direto para outra aula
- 1 A segunda onda
- 2 Do chatbot ao sistema que executa
- 3 Tudo o que não é o modelo
- 4 O contrato entre máquinas
- 5 O que a IA precisa saber
- 6 O modelo nunca aperta o botão
- 7 Achar pelo sentido
- 8 Prova com consulta
- 9 O que mora entre os documentos
- 10 A fonte vencida e o teste que sabe falhar
- 11 O agente e quem diz que ele terminou
- 12 Um processo que cabe num desenho
- 13 Peça ao modelo só o que só ele sabe
- 14 Dividir o trabalho, dividir o erro
- 15 Aprovar não é olhar
- 16 Um jeito de desfazer
- 17 Até onde o erro alcança
- 18 Quem acorda de madrugada
- 19 A fatura e o registro
- 20 Quando ninguém estiver calmo
- 21 Automação que erra igual e avisa
- 22 Todo texto pode soar como ordem
- 23 Um agente sem nome próprio
- 24 O dado que nunca precisou chegar
- 25 O sistema inteiro