Gleam.br Wiki

GBR: ADR-0005 Otimização Semântica de Tokens e Redação de PII | Wiki

Documentação de engenharia e especificações técnicas da Gleam-BR.

GBR: ADR-0005 Otimização Semântica de Tokens e Redação de PII

  • *Status:* Feito
  • *Data:* 2026-05-14

*Contexto:*

O custo operacional de Agentes de IA é ditado pelo volume de tokens trafegados. Em fluxos de desenvolvimento (Frente ALPHA), saídas de terminal e logs costumam conter ruídos excessivos que consomem janelas de contexto e aumentam a latência e o custo. Adicionalmente, o envio de Dados Pessoais Sensíveis (PII) ou segredos jurídicos para provedores de nuvem viola políticas de conformidade (LGPD/GDPR) e expõe a organização a riscos de vazamento de dados.

*Decisão:*

Implementaremos uma camada de *Pré-processamento de Contexto* no módulo gbr_llm, composta por:

  1. *Filtro RTK (Semantic Compression):* Antes do envio, saídas de ferramentas (MCP) passarão por um redutor de ruído que colapsa linhas repetidas, remove boilerplate e resume logs extensos, reduzindo a pegada de tokens em até 80%.
  2. *Privacy Vault (Redaction):* Implementaremos um sistema de Tokenização de Privacidade. Dados sensíveis identificados por padrões serão substituídos por identificadores sintéticos de forma determinística no lado cliente (Edge).
  3. *Local Rehydration:* O Ator do REPL será responsável por restaurar os dados originais nas respostas da IA, utilizando um mapa de tradução temporário armazenado localmente, garantindo que a nuvem permaneça em um estado de "Conhecimento Zero" sobre entidades sensíveis.

*Consequências:*

  • *Positivas:* Redução drástica no custo de API; conformidade nativa com leis de proteção de dados; proteção da propriedade intelectual da organização.
  • *Negativas:* Aumento no processamento local (CPU) para execução de Regex e filtros; risco de a IA perder contexto se a redação for agressiva demais (ex: ocultar um nome que era vital para o entendimento jurídico).