Clareza: análise auditável de declarações

EvidênciasRevisão editorialFastAPINext.js

Sumário

Plataforma para pesquisa e verificação estruturada de declarações públicas, com armazenamento de fontes primárias, revisão editorial e controle de proveniência de dados.

Visão geral

O Clareza é um sistema voltado à checagem estruturada e auditável de declarações públicas. A plataforma vincula cada afirmação às suas fontes originais, armazena o histórico de evidências consultadas e exige validação editorial antes da publicação.

O modelo de dados assegura rastreabilidade ponta a ponta. Cada veredito emitido fica vinculado a registros persistidos de texto, datas de coleta e parâmetros de avaliação, permitindo a verificação independente de qualquer análise produzida.

Fluxo de avaliação

O processamento das declarações segue seis etapas sequenciais:

  1. Afirmação. Registro do texto original da declaração com autor, data e contexto de emissão.
  2. Pesquisa. Recuperação automatizada de fontes documentais e persistência das respostas brutas.
  3. Evidências. Extração e indexação dos trechos relevantes para subsidiar a verificação.
  4. Avaliação preliminar. Geração de parecer técnico estruturado a partir das evidências catalogadas.
  5. Revisão editorial. Conferência humana de consistência, qualidade das fontes e clareza textual.
  6. Publicação e versionamento. Disponibilização pública do registro com histórico de revisões e correções.

O sistema registra o ciclo completo de produção da análise, desde a consulta inicial até a aprovação final. Estados intermediários, como dados em processamento ou análises aguardando revisão, ficam explícitos no painel operacional.

Políticas de publicação e segurança

A publicação de análises exige ao menos uma fonte primária confirmada no repositório de evidências e validação assinada por revisor editorial. Casos com documentação insuficiente recebem a classificação de status inconclusivo e permanecem arquivados com o registro das buscas executadas.

A integração com modelos de linguagem opera sob restrições estritas de entrada e saída. As consultas ao modelo utilizam apenas os fragmentos documentais previamente coletados e validados, rejeitando links não catalogados. O serviço de busca web aplica bloqueios de rede para faixas privadas, endereços locais (loopback e link-local), multicast e esquemas não HTTP, mitigando vulnerabilidades de SSRF (Server-Side Request Forgery).

Arquitetura de software

  • Next.js e TypeScript. Interface para visualização pública das checagens e painel de trabalho editorial.
  • FastAPI. Serviços de ingestão de afirmações, orquestração de pesquisa e controle de estados de publicação.
  • PostgreSQL. Modelo relacional para entidades, citações, metadados de fontes e trilhas de auditoria.
  • Redis e Celery. Fila assíncrona para execução escalável de tarefas de busca e pré-processamento de texto.
  • Docker. Contêineres padronizados para execução local e integração contínua.

A arquitetura desacopla a camada de extração de dados dos provedores de inferência de linguagem, viabilizando a substituição de motores de busca ou modelos de apoio sem modificação no esquema relacional. Um ambiente de demonstração baseado em geradores determinísticos permite simular fluxos editoriais complexos para testes de interface e carga.

Escopo operacional

A versão atual constitui uma base funcional para fluxos de checagem. A evolução da infraestrutura contempla a inclusão de conectores diretos para diários oficiais, integração com repositórios de dados abertos governamentais, autenticação baseada em funções (RBAC) e rotinas automatizadas de redundância em banco de dados.