Estado único do processo
Produto final: entregue este arquivo a qualquer IA.
#VAZIO — nada processado ainda.
Validação cruzada (regras, sem IA)
—
v2 · triagem por folha · OCR sob demanda · estado único
Lê o PDF no navegador, decide folha por folha se o texto é confiável e só manda para OCR as folhas digitalizadas ou com miolo sem texto (OCR local, no próprio navegador). O texto limpo entra em blocos que cabem no tier barato (≤ 32k tokens) e cada bloco devolve apenas linhas novas ou correções para um único estado. Transcrição de audiência entra como segunda fonte no mesmo estado. Verificação opcional pelo TypeSafe/JEV (triagem, apoio das linhas no trecho e contradições).
Nenhuma folha na fila.
| folha | PP-OCRv6 chars | conf. | ms | Tesseract chars | conf. | ms | semelhança |
|---|
Motor validado do produto: PP-OCRv6 Small via ONNX/WASM, ~1,2 s por folha no Chrome (4 threads) e ~3,6 s com 1 thread (as 45 folhas digitalizadas do processo de exemplo levariam cerca de 1 min). O Tesseract.js roda em paralelo só para comparar: escolha "os dois" e use "Comparar motores" para ver, na mesma folha, caracteres, confiança, tempo e a semelhança entre as duas leituras — a decisão fica com número, não com impressão.
Leia o PDF para triar.
—
Os tokens ficam apenas na memória da aba e vão para o servidor local, que fala com os provedores. Nada é gravado no projeto.
Leia o PDF para calcular os blocos.
Nenhuma fonte selecionada.
| chamada | bloco | entrada (est.) | saída | tokens (provedor) | segundos | linhas | refs |
|---|
Produto final: entregue este arquivo a qualquer IA.
#VAZIO — nada processado ainda.
—
O mapa diz onde cada assunto está (faixas automáticas pelo tipo da peça + faixas da IA).
Nada aberto.
—
—
Resposta com base apenas no estado; se faltar, a IA indica a faixa de folhas a abrir na consulta acima.
—
Julgamentos tipados e baratos, em paralelo à extração: confirmar a triagem das folhas ambíguas, checar se cada linha acrescentada tem apoio no trecho e procurar contradições no estado consolidado.
—