GBR: ADR-0005 Otimização Semântica de Tokens e Redação de PII | Wiki
Documentação de engenharia e especificações técnicas da Gleam-BR.
GBR: ADR-0005 Otimização Semântica de Tokens e Redação de PII
- *Status:* Feito
- *Data:* 2026-05-14
*Contexto:*
O custo operacional de Agentes de IA é ditado pelo volume de tokens trafegados. Em fluxos de desenvolvimento (Frente ALPHA), saídas de terminal e logs costumam conter ruídos excessivos que consomem janelas de contexto e aumentam a latência e o custo. Adicionalmente, o envio de Dados Pessoais Sensíveis (PII) ou segredos jurídicos para provedores de nuvem viola políticas de conformidade (LGPD/GDPR) e expõe a organização a riscos de vazamento de dados.
*Decisão:*
Implementaremos uma camada de *Pré-processamento de Contexto* no módulo gbr_llm, composta por:
- *Filtro RTK (Semantic Compression):* Antes do envio, saídas de ferramentas (MCP) passarão por um redutor de ruído que colapsa linhas repetidas, remove boilerplate e resume logs extensos, reduzindo a pegada de tokens em até 80%.
- *Privacy Vault (Redaction):* Implementaremos um sistema de Tokenização de Privacidade. Dados sensíveis identificados por padrões serão substituídos por identificadores sintéticos de forma determinística no lado cliente (Edge).
- *Local Rehydration:* O Ator do REPL será responsável por restaurar os dados originais nas respostas da IA, utilizando um mapa de tradução temporário armazenado localmente, garantindo que a nuvem permaneça em um estado de "Conhecimento Zero" sobre entidades sensíveis.
*Consequências:*
- *Positivas:* Redução drástica no custo de API; conformidade nativa com leis de proteção de dados; proteção da propriedade intelectual da organização.
- *Negativas:* Aumento no processamento local (CPU) para execução de Regex e filtros; risco de a IA perder contexto se a redação for agressiva demais (ex: ocultar um nome que era vital para o entendimento jurídico).