v4 · leitura + triagem + limpeza + OCR (Tesseract) · documento único retomável

Leitura completa + documento único

Selecione um PDF: o navegador lê e tria cada folha, remove carimbo, aplica o dicionário ¤n e roda OCR Tesseract nas digitalizadas. Depois analisa folha por folha (em paralelo) com a IA e acumula tudo num documento único, salvo a cada folha — se a API falhar, o trabalho continua de onde parou.

Cada folha é analisada individualmente; os achados entram no documento único na ordem das folhas, sem uma segunda chamada de IA para reescrever tudo. Folhas já analisadas ficam salvas e não são repetidas.

O token fica apenas na memória desta aba e é enviado ao servidor local. Ele não é salvo no HTML, no navegador ou no projeto.

Verificando gateway de IA…

Nenhum arquivo selecionado.

Texto preparado

Limpo (carimbo removido) com dicionário ¤n aplicado — é o que a IA recebe, folha a folha.

Páginas preparadas

Uma unidade de análise por página.

Extraia o PDF para visualizar as páginas.