Memória de agentes: o que guardar, esquecer ou nunca coletar
“O agente lembra de mim” parece ótimo até recuperar um detalhe sensível na conversa errada, tratar uma preferência antiga como permanente ou não saber explicar de onde veio um fato. Memória não é um histórico de prompt maior: é um sistema de dados com escopo, responsável, confiança, retenção e exclusão. Defina o que merece persistir antes de escolher um banco vetorial.
Publicado em 28 de setembro de 202613 min de leituraPersonalização e privacidade
Classifique antes de escolher onde armazenar
Valor, duração e risco variam conforme a informação
Contexto da sessãoNecessário para esta tarefa; expira com a conversa.
Preferência útilExplícita, editável e vinculada à pessoa.
Fato temporárioTem origem, confiança e data de expiração.
Não reterSegredos, dados sensíveis desnecessários e suposições.
Informação
Tratamento padrão
Controle necessário
Detalhes da tarefa atual
Estado temporário da conversa
Prazo de retenção e ação de limpar
“Prefiro respostas curtas”
Persistir só com benefício claro
Visível, editável e removível
Prazo de um projeto
Guardar com origem e vencimento
Atualizar ou marcar como desatualizado
Dados de saúde, finanças ou identidade
Não guardar por padrão
Finalidade específica e acesso estrito, se indispensável
Senha, token ou código de recuperação
Nunca incluir na memória do agente
Usar gerenciador de segredos fora do contexto do modelo
Traço sensível inferido
Não transformar palpite em fato
Exigir confirmação e necessidade comprovada
Separe estado de curto prazo e memória duradoura
Continuidade de uma conversa e personalização futura são necessidades distintas. Um checkpoint pode preservar uma tarefa interrompida; uma memória associada ao usuário pode guardar poucas preferências entre sessões. Não copie todas as mensagens para uma tabela de memória. Resumos também podem conter dados sensíveis e precisam de controles de acesso, prazo e exclusão.
Separe dados por pessoa ou organização no armazenamento e aplique autorização antes da recuperação. Uma instrução no prompt não substitui controle de acesso. Audite leituras e gravações sem registrar os próprios valores sensíveis.
Deixe a memória visível e corrigível
Registre tipo, escopo, origem, horário, confiança, última confirmação e expiração. Mostre à pessoa o que foi lembrado em linguagem clara, não como vetores. Permita corrigir, apagar ou desativar a função. Se a lembrança vier de uma inferência, peça confirmação quando o impacto justificar; caso contrário, mantenha-a temporária.
Projete o esquecimento como um fluxo completo
A exclusão precisa alcançar registros principais, resumos derivados, índices vetoriais, caches e backups conforme a política informada. Marque o item para não ser recuperado imediatamente enquanto a limpeza assíncrona termina. Defina o tratamento de auditoria e retenção legal sem prometer remoção instantânea de todo backup. Teste periodicamente se o identificador e paráfrases do conteúdo apagado ainda são encontrados.
Expiração não é exclusão se o dado vencido ainda aparece em buscas. Remova também embeddings e índices. Confirme novamente fatos que mudam, como cargo, empresa, projeto e localização. Em caso de baixa confiança ou fontes contraditórias, pergunte em vez de sobrescrever silenciosamente.
Minimize antes de criptografar e restringir
É melhor guardar uma preferência curta do que a conversa inteira, uma referência em vez de uma cópia de documento e uma nota de tarefa em vez de um perfil permanente. Credenciais nunca devem ficar numa memória acessível ao modelo; use um cofre de segredos e permissões limitadas para ferramentas.
Memórias recuperadas também podem carregar prompt injection. Trate o texto como entrada não confiável, delimite-o e impeça que altere políticas ou permissões. Teste isolamento entre usuários, reaparecimento de fatos apagados e tentativas de instalar instruções persistentes.
Meça utilidade junto com risco
Acompanhe se a memória reduz perguntas repetidas e melhora tarefas, junto de correções por desatualização, demora de exclusão, falhas de isolamento e desativações. Compare o comportamento com e sem memória. Se o ganho for pequeno e a superfície de privacidade crescer, não persista o dado.
Em resumo
Boa memória de agente é pequena, contextual, explicável e apagável. Mantenha estado de tarefa temporário, persista apenas fatos úteis e aprovados, associe origem e vencimento e remova também as derivações. Segredos e inferências sensíveis não pertencem à memória conversacional. Persistência deve ser conquistada pelo valor claro que entrega.