Base RCO / Documentação
# Estrutura recomendada — Agente Redshift RCO ## 1. Catálogo físico (fonte de verdade) Arquivos 01 a 08 e o `09_kb_objetos_rag.jsonl`. Deve ser atualizado por carga versionada, não por conversa. ## 2. Camada semântica Taxonomias, `semantic_tags`, conceitos sugeridos, sinônimos aprovados e relações de negócio validadas. Esta camada ajuda o agente a converter “contas atrasadas”, “reclamações”, “faturamento” etc. em candidatos de tabela/campo. ## 3. Motor de geração SQL Aplicar validador antes de devolver qualquer SQL. O validador deve rejeitar: `SELECT *`, `DISTINCT`, `WITH`, DML/DDL e objetos/campos fora do catálogo. Também deve sinalizar subqueries, ausência de filtro temporal em explorações grandes e `CROSS JOIN`. ## 4. Memória Separar memória do usuário de conhecimento corporativo. Conversas podem sugerir novos sinônimos e relações, mas esses itens ficam em `candidate_knowledge` até validação. ## 5. Feedback e evolução Salvar: pergunta, objetos recuperados, SQL gerado, query aceita/corrigida, erro retornado pelo Redshift e feedback do usuário. Usar isso para melhorar ranking de fontes e detectar lacunas no catálogo. Não treinar significado de campo automaticamente a partir de uma query isolada. ## 6. Fluxo ideal Pergunta em linguagem simples → identificação de empresa/intenção → recuperação de 3 a 8 objetos candidatos → validação de campos → geração SQL → lint/regras → resposta + alternativas/dicas → feedback/memória candidata.