Texto preparado
Limpo (carimbo removido) com dicionário ¤n aplicado — é o que a IA recebe, folha a folha.
v4 · leitura + triagem + limpeza + OCR (Tesseract) · documento único retomável
Selecione um PDF: o navegador lê e tria cada folha, remove carimbo, aplica o dicionário
¤n e roda OCR Tesseract nas digitalizadas. Depois analisa folha por folha
(em paralelo) com a IA e acumula tudo num documento único, salvo a cada folha —
se a API falhar, o trabalho continua de onde parou.
Cada folha é analisada individualmente; os achados entram no documento único na ordem das folhas, sem uma segunda chamada de IA para reescrever tudo. Folhas já analisadas ficam salvas e não são repetidas.
O token fica apenas na memória desta aba e é enviado ao servidor local. Ele não é salvo no HTML, no navegador ou no projeto.
Nenhum arquivo selecionado.
Limpo (carimbo removido) com dicionário ¤n aplicado — é o que a IA recebe, folha a folha.
Uma unidade de análise por página.
Extraia o PDF para visualizar as páginas.
Folhas digitalizadas detectadas na triagem podem ser lidas localmente pelo Tesseract.js (motor no próprio servidor) ou pela visão do Qwen 3.7 Flash (foto da página enviada ao gateway); cada leitura fica salva.
Nenhuma folha na fila.
—
—
Achados por folha (salvos individualmente; falhas podem ser retomadas).
Status por folha: aguardando, concluída ou falhou — o que já está salvo não se repete.
Atualiza a cada folha analisada e fica salvo no navegador; pronto para baixar como texto.
Nada salvo ainda.