Solução rápida: O aplicativo Windows Scan da Microsoft Store não inclui OCR. Para OCR: digitalize para PDF, abra o PDF no Microsoft OneNote → clique com o botão direito na imagem → Copiar texto da imagem. Ou use o Microsoft PowerToys → Text Extractor gratuito (Win+Shift+T). Ou a camada gratuita de OCR do Adobe Acrobat. Ou use ferramentas online como onlineocr.net para OCR ocasional gratuito.
O aplicativo Windows Scan lida com a digitalização, mas não com OCR (Reconhecimento Óptico de Caracteres). Para tornar documentos digitalizados pesquisáveis: combine o Windows Scan com uma ferramenta de OCR. Pilha comum: Digitalizar → PDF → OCR via OneNote ou Acrobat.
Afeta: Windows 11 com scanner conectado.
Tempo de correção: ~10 minutos de configuração.
O que causa essa necessidade
Digitalizar um documento em papel gera uma imagem. O texto na imagem não é pesquisável, não pode ser copiado. O OCR torna o texto selecionável/pesquisável. Útil para: recibos (pesquisar por data), livros (pesquisa de texto completo), documentos legais (encontrar citações), anotações (reformatar para um novo formato).
Método 1: Digitalizar com Windows Scan, OCR com OneNote
O fluxo nativo da Microsoft.
- Abra o aplicativo Windows Scan (Microsoft Store). Gratuito.
- Escolha o scanner na lista.
- Configure: fonte (plano/alimentador), cor/escala de cinza, resolução (300dpi para OCR).
- Clique em Digitalizar. A imagem é salva como PNG ou PDF (dependendo das configurações).
- Para saída PDF: escolha Tipo de arquivo: PDF.
- Abra a imagem resultante no Microsoft OneNote.
- No OneNote: clique com o botão direito na imagem inserida → Copiar texto da imagem.
- O OneNote executa OCR na imagem. O texto extraído vai para a área de transferência.
- Cole em qualquer lugar (Word, Bloco de Notas, e-mail).
- Para documentos com várias páginas: insira todas as páginas no OneNote e faça OCR em cada uma.
Esta é a rota do OneNote.
Método 2: PowerToys Text Extractor para OCR seletivo
Para OCR rápido na tela.
- Instale o Microsoft PowerToys da Microsoft Store.
- Abra o PowerToys → Text Extractor. Ative.
- Atalho padrão: Win + Shift + T.
- Pressione o atalho. A tela escurece com cursor de mira.
- Arraste um retângulo sobre o texto que deseja extrair. O OCR é executado.
- O texto é copiado para a área de transferência.
- Cole em qualquer lugar.
- Para documentos digitalizados: abra a imagem digitalizada em tela cheia, pressione o atalho, arraste sobre o texto. Funciona em qualquer imagem na tela.
- Suporta muitos idiomas. Configurações → Text Extractor → escolha os idiomas a incluir.
- Para lote: ainda por seleção. Para lote de página inteira, use o Método 3.
Esta é a abordagem de tela ao vivo.
Método 3: Adobe Acrobat ou terceiros para OCR de página inteira
Para OCR abrangente de documentos.
- Adobe Acrobat (pago ou teste gratuito):
- Abra o PDF no Acrobat. Ferramentas → Digitalizar e OCR.
- Escolha Reconhecer texto. O Acrobat aplica OCR no documento.
- O PDF resultante tem uma camada de texto pesquisável.
- Use Localizar (Ctrl+F) para pesquisar. Copie texto selecionando.
- ABBYY FineReader (pago, topo de linha): melhor qualidade de OCR. Vale a pena para uso intenso.
- Gratuito: Tesseract (código aberto). OCR via linha de comando. Use com wrappers GUI como gImageReader.
- Online: onlineocr.net (gratuito): envie imagem, obtenha texto. Atenção: os dados vão para o servidor deles. Evite para documentos confidenciais.
- Online: Microsoft Lens (aplicativo móvel + conta Microsoft): digitalize com a câmera do celular, OCR via Microsoft 365.
- Para processamento em lote: um script usando Tesseract:
for /f %i in ('dir /b *.png') do tesseract %i %~niConverte cada PNG em arquivo de texto.
- Para assinantes do Office 365: Lens integrado no OneDrive. Captura pelo celular → OCR → PDF.
Esta é a rota abrangente.
Como verificar se a correção funcionou
- O texto digitalizado está selecionável/pesquisável no PDF (após OCR).
- Copiar texto da imagem (OneNote) retorna texto reconhecível.
- O PowerToys Text Extractor copia texto para a área de transferência.
- O texto colado corresponde ao conteúdo digitalizado (com taxa normal de erro de OCR).
Se nenhum desses funcionar
Se a qualidade do OCR for ruim: Resolução muito baixa: digitalize com no mínimo 300dpi. Inclinação/rotação: digitalize reto; ou corrija a inclinação com uma ferramenta de imagem primeiro. Problemas de cor: digitalize em escala de cinza, contraste em cerca de 50% para documentos digitados. Texto manuscrito: OCR é ruim para caligrafia. Use ferramentas especializadas como Pen and Ink OCR. Texto não inglês: certifique-se de que a ferramenta de OCR suporta o idioma. O Tesseract tem pacotes para mais de 100 idiomas. Para fotos de smartphone de baixa qualidade: gire, corte, aumente o contraste primeiro. Para PDFs com texto incorporado: nem todos os PDFs precisam de OCR; verifique Ctrl+F primeiro. Para documentos muito longos: OCR em lote via Tesseract ou ABBYY. Para erros crônicos de OCR: treine o Tesseract em uma fonte específica (avançado). Ou pague pelo ABBYY para qualidade consistente.
Conclusão: Windows Scan para digitalização — combine com OneNote (Copiar texto da imagem) ou PowerToys Text Extractor (Win+Shift+T) para OCR básico. Use Adobe Acrobat ou Tesseract para OCR de documentos de página inteira.