Como configurar um fluxo de OCR com o aplicativo Windows Scan
🔍 WiseChecker

Como configurar um fluxo de OCR com o aplicativo Windows Scan

Solução rápida: O aplicativo Windows Scan da Microsoft Store não inclui OCR. Para OCR: digitalize para PDF, abra o PDF no Microsoft OneNote → clique com o botão direito na imagem → Copiar texto da imagem. Ou use o Microsoft PowerToys → Text Extractor gratuito (Win+Shift+T). Ou a camada gratuita de OCR do Adobe Acrobat. Ou use ferramentas online como onlineocr.net para OCR ocasional gratuito.

O aplicativo Windows Scan lida com a digitalização, mas não com OCR (Reconhecimento Óptico de Caracteres). Para tornar documentos digitalizados pesquisáveis: combine o Windows Scan com uma ferramenta de OCR. Pilha comum: Digitalizar → PDF → OCR via OneNote ou Acrobat.

Sintoma: Deseja um fluxo de OCR no Windows 11 usando o aplicativo Windows Scan ou similar.
Afeta: Windows 11 com scanner conectado.
Tempo de correção: ~10 minutos de configuração.

ADVERTISEMENT

O que causa essa necessidade

Digitalizar um documento em papel gera uma imagem. O texto na imagem não é pesquisável, não pode ser copiado. O OCR torna o texto selecionável/pesquisável. Útil para: recibos (pesquisar por data), livros (pesquisa de texto completo), documentos legais (encontrar citações), anotações (reformatar para um novo formato).

Método 1: Digitalizar com Windows Scan, OCR com OneNote

O fluxo nativo da Microsoft.

  1. Abra o aplicativo Windows Scan (Microsoft Store). Gratuito.
  2. Escolha o scanner na lista.
  3. Configure: fonte (plano/alimentador), cor/escala de cinza, resolução (300dpi para OCR).
  4. Clique em Digitalizar. A imagem é salva como PNG ou PDF (dependendo das configurações).
  5. Para saída PDF: escolha Tipo de arquivo: PDF.
  6. Abra a imagem resultante no Microsoft OneNote.
  7. No OneNote: clique com o botão direito na imagem inserida → Copiar texto da imagem.
  8. O OneNote executa OCR na imagem. O texto extraído vai para a área de transferência.
  9. Cole em qualquer lugar (Word, Bloco de Notas, e-mail).
  10. Para documentos com várias páginas: insira todas as páginas no OneNote e faça OCR em cada uma.

Esta é a rota do OneNote.

ADVERTISEMENT

Método 2: PowerToys Text Extractor para OCR seletivo

Para OCR rápido na tela.

  1. Instale o Microsoft PowerToys da Microsoft Store.
  2. Abra o PowerToys → Text Extractor. Ative.
  3. Atalho padrão: Win + Shift + T.
  4. Pressione o atalho. A tela escurece com cursor de mira.
  5. Arraste um retângulo sobre o texto que deseja extrair. O OCR é executado.
  6. O texto é copiado para a área de transferência.
  7. Cole em qualquer lugar.
  8. Para documentos digitalizados: abra a imagem digitalizada em tela cheia, pressione o atalho, arraste sobre o texto. Funciona em qualquer imagem na tela.
  9. Suporta muitos idiomas. Configurações → Text Extractor → escolha os idiomas a incluir.
  10. Para lote: ainda por seleção. Para lote de página inteira, use o Método 3.

Esta é a abordagem de tela ao vivo.

Método 3: Adobe Acrobat ou terceiros para OCR de página inteira

Para OCR abrangente de documentos.

  1. Adobe Acrobat (pago ou teste gratuito):
    • Abra o PDF no Acrobat. Ferramentas → Digitalizar e OCR.
    • Escolha Reconhecer texto. O Acrobat aplica OCR no documento.
    • O PDF resultante tem uma camada de texto pesquisável.
    • Use Localizar (Ctrl+F) para pesquisar. Copie texto selecionando.
  2. ABBYY FineReader (pago, topo de linha): melhor qualidade de OCR. Vale a pena para uso intenso.
  3. Gratuito: Tesseract (código aberto). OCR via linha de comando. Use com wrappers GUI como gImageReader.
  4. Online: onlineocr.net (gratuito): envie imagem, obtenha texto. Atenção: os dados vão para o servidor deles. Evite para documentos confidenciais.
  5. Online: Microsoft Lens (aplicativo móvel + conta Microsoft): digitalize com a câmera do celular, OCR via Microsoft 365.
  6. Para processamento em lote: um script usando Tesseract:
    for /f %i in ('dir /b *.png') do tesseract %i %~ni

    Converte cada PNG em arquivo de texto.

  7. Para assinantes do Office 365: Lens integrado no OneDrive. Captura pelo celular → OCR → PDF.

Esta é a rota abrangente.

ADVERTISEMENT

Como verificar se a correção funcionou

  • O texto digitalizado está selecionável/pesquisável no PDF (após OCR).
  • Copiar texto da imagem (OneNote) retorna texto reconhecível.
  • O PowerToys Text Extractor copia texto para a área de transferência.
  • O texto colado corresponde ao conteúdo digitalizado (com taxa normal de erro de OCR).

Se nenhum desses funcionar

Se a qualidade do OCR for ruim: Resolução muito baixa: digitalize com no mínimo 300dpi. Inclinação/rotação: digitalize reto; ou corrija a inclinação com uma ferramenta de imagem primeiro. Problemas de cor: digitalize em escala de cinza, contraste em cerca de 50% para documentos digitados. Texto manuscrito: OCR é ruim para caligrafia. Use ferramentas especializadas como Pen and Ink OCR. Texto não inglês: certifique-se de que a ferramenta de OCR suporta o idioma. O Tesseract tem pacotes para mais de 100 idiomas. Para fotos de smartphone de baixa qualidade: gire, corte, aumente o contraste primeiro. Para PDFs com texto incorporado: nem todos os PDFs precisam de OCR; verifique Ctrl+F primeiro. Para documentos muito longos: OCR em lote via Tesseract ou ABBYY. Para erros crônicos de OCR: treine o Tesseract em uma fonte específica (avançado). Ou pague pelo ABBYY para qualidade consistente.

Conclusão: Windows Scan para digitalização — combine com OneNote (Copiar texto da imagem) ou PowerToys Text Extractor (Win+Shift+T) para OCR básico. Use Adobe Acrobat ou Tesseract para OCR de documentos de página inteira.

ADVERTISEMENT