Pré-processamento de PDFs
OCR — como tornar o processo pesquisável
Boa parte dos processos vem em PDF imagem — o documento foi escaneado e cada página é uma foto. O Copilot até abre, mas não lê o texto direito. A solução é rodar OCR antes — converter a imagem em texto pesquisável.
Como saber se o PDF precisa de OCR
Abra o PDF e tente selecionar texto com o mouse:
- ✗Não consegue selecionar, ou o cursor seleciona a página inteira como se fosse uma imagem → é PDF imagem, precisa de OCR.
- ✓Seleciona letra por letra, pode copiar e colar o texto → já é PDF pesquisável, pode mandar direto pro Copilot.
Sintoma típico do Copilot lendo PDF sem OCR: respostas vagas (“não consegui identificar o conteúdo”), trechos com [ilegível], ou ele simplesmente analisa “a imagem” em vez do texto.
Como rodar OCR no Adobe Acrobat
O Adobe Acrobat Pro faz OCR direto no arquivo. Em ~30 segundos por processo médio, o PDF vira pesquisável e pode ser mandado pro Copilot. O Acrobat Pro não vem instalado nas máquinas do TJMS — recomenda-se assinar (vale o investimento pra quem trabalha com volume de PDFs escaneados).
Dig. e conv. em texto
Passo a passo
- 1.Abra o PDF no Adobe Acrobat Pro (não no Adobe Reader gratuito — esse não tem OCR).
- 2.Na barra superior, clique em Converter → Dig. e conv. em texto(sigla de “Digitalizar e converter em texto”).
- 3.Na seção Reconhecer texto, clique em Neste arquivo.
- 4.No popup: Páginas = Todas as páginas; Idioma = Português (Brasil). Clique Reconhecer texto.
- 5.Aguarde o processamento (~10–60s dependendo do tamanho). Salve o PDF (Ctrl+S). Agora ele já é pesquisável.
Como conferir se o OCR funcionou
- 1.Use Ctrl+F dentro do PDF e busque uma palavra que você sabe que está lá (ex: o nome de uma parte). Se achar e destacar, OCR ok.
- 2.Selecione um trecho com o mouse — deve marcar letra por letra, não bloco/imagem.
- 3.Copie um parágrafo e cole no Word ou no chat. Se vier texto legível (com eventuais erros pontuais de OCR), está pronto pra ir pro Copilot.
Vale o esforço?
Sim. Os ~30 segundos do OCR economizam minutos de Copilot tentando adivinhar o conteúdo de imagens e, principalmente, evitam que a análise saia incompleta ou errada. Quando o processo vier escaneado, rode OCR antes de mandar pra IA — é o pré-processamento de maior retorno do gabinete.