Ferramenta de OCR e transcrição de imagens | Exporte tabelas e formulários em CSV e TSV

OCR em português e inglês no dispositivoTextos impressos, recibos, formulários e tabelasProcesse várias imagens em sequênciaSem cadastro ou instalação

Escolher imagem para leitura

Ajuste o processamento de imagem, direção do texto e layout conforme o uso.

Escolher imagem

Arraste a imagem aquiJPEG, PNG, WebP, BMP, até 20 imagens
Priorize a câmera traseira do dispositivo para fotografar o documento no local.
Nenhuma imagem selecionada ainda.

Configurações de OCR

Ajustar rotação, inclinação e recorte
Margem a cortar (porcentagem de cada lado da imagem)
Organizar texto reconhecido

Imagem e resultado do OCR

Selecione uma imagem para ver o resultado após a correção.

0 / 0
A imagem será exibida aquiQuanto mais horizontal o texto e menos sombras e margens, mais fácil é o reconhecimento.
Aguardando0%

As imagens e os resultados do reconhecimento não são enviados ao servidor. O mecanismo OCR e os dicionários também são carregados do WiseChecker.

O que esta ferramenta de OCR pode fazer

Extraia texto impresso em português, inglês e números de digitalizações, fotos, recibos, formulários, etiquetas e tabelas. Revise o resultado, copie ou salve em TXT, CSV e TSV.

As imagens e o texto reconhecido permanecem no navegador. O mecanismo e os dicionários de português e inglês são servidos pelo WiseChecker.

OCR em português e inglês

Reconheça parágrafos, rótulos, datas, valores e identificadores.

Correção de documentos

Ajuste tons de cinza, contraste, limiar, inversão e corte.

Revise baixa confiança

Vá direto às palavras que precisam ser comparadas com a imagem.

Exporte tabelas

Estime colunas e salve CSV ou TSV para concluir a revisão.

Passos para transcrever texto de imagens

  1. Escolha o tipo de imagemEscolha a finalidade mais próxima: documentos, faturas/recibos, tabelas/formulários ou texto vertical.
  2. Carregar imagemNo PC, você pode usar seleção de imagem, arrastar e soltar e colar. Em smartphones e tablets compatíveis, use ‘Fotografar documento’ para abrir a câmera do dispositivo.
  3. Ver imagem corrigidaAjuste orientação, inclinação, margens e intensidade do texto para facilitar a leitura.
  4. Executar transcriçãoProcessa apenas uma imagem ou todas as imagens carregadas em sequência. A primeira vez requer tempo para carregar o mecanismo OCR e os dicionários.
  5. Comparar candidatos de verificação com a imagem originalVerifique principalmente palavras com confiança abaixo de 70, valores, datas, códigos de produto e nomes próprios.
  6. Salvar em formato adequado ao usoSalve textos como TXT e tabelas como CSV ou TSV. Você também pode corrigir na tela e copiar.

Configurações para ler faturas, recibos e formulários

Ao escolher ‘Faturas e recibos’, é aplicado um processamento em preto e branco que reduz variações de brilho e sombras do papel, lendo como uma área contínua. Se datas, números de nota fiscal, números de registro, valores, alíquotas e nomes de produtos estiverem distantes, mudar ‘Disposição do texto’ para ‘Texto espaçado e itens’ pode melhorar.

Em ‘Tabelas e formulários’, os espaços entre palavras são preservados e os limites de coluna são estimados a partir da posição horizontal das palavras reconhecidas. A aba de tabela é exibida com separação por tabulação e pode ser colada diretamente no Excel. Ao salvar CSV, nomes de produtos e valores com vírgulas são colocados entre aspas.

Tipo de imagemEscolha o uso primeiroRevisar configuraçõesCaracteres a verificar especificamente
FaturaFaturas e recibosCorreção de sombras, caracteres e itens distantesNúmero da fatura, número de registro, valor, alíquota
ReciboFaturas e recibosRecorte de margens, correção de inclinaçãoData, quantidade, preço unitário, total, nome da loja
Formulários e checklistsTabelas e formuláriosManter espaços, converter para preto e brancoCampos de seleção, valores preenchidos, unidades, notas fora do campo
Avisos e atasDocumentos e avisosDetecção automática de parágrafos, correção de cinzaNomes próprios, datas, URLs e endereços de e-mail

Como tirar fotos que melhoram a precisão do reconhecimento de texto

A precisão do OCR depende do tamanho dos caracteres, foco, inclinação, sombras, fundo e compressão. Em smartphones, mantenha o documento paralelo à câmera e posicione os quatro cantos dentro da tela. Se a iluminação superior refletir fortemente no papel, mude ligeiramente o ângulo do dispositivo ou da luz.

  • Fotografe com resolução que mostre o contorno dos caracteres e use o original em vez de imagens recompactadas em redes sociais ou chats.
  • Para fotos com bordas escuras, escolha “suprimir sombras e binarizar”.
  • Remova mesas e fundos fora do documento com o corte de margens.
  • Use os botões de rotação para 90 graus e a correção de inclinação para alguns graus.
  • Aumente o contraste para impressão fraca. Para caracteres desbotados, a conversão para preto e branco pode ser contraproducente; compare também com a correção em tons de cinza.

Imagens pequenas são ampliadas automaticamente. A ampliação não restaura informações inexistentes na imagem original, mas ajuda o mecanismo OCR a analisar o contorno dos caracteres em um tamanho adequado. Se a imagem tiver baixa resolução, desfoque ou estouro de branco que perdeu caracteres, refotografar é a solução mais confiável.

Diferença entre correção de cinza, preto e branco e correção de sombra

Correção de imagemImagem adequadaConteúdo do processamentoSe não funcionar
Escala de cinza e correção de contrasteDigitalizações, documentos impressos, texto claroConverte cores em brilho e expande áreas escuras e claras.Se a sombra do fundo for forte, a sombra também será mantida como texto.
Reduzir sombras e converter para P&BFotos de smartphone, recibosCompara com o brilho ao redor e separa o texto em preto e branco.Sombreamentos, fotos e linhas finas podem desaparecer.
Preto e brancoDocumentos com contraste claroCalcula o valor limite de toda a imagem e separa em preto e branco.Iluminação irregular pode fazer com que alguns caracteres fiquem cortados.
Sem ajusteDigitalização já nítidaFaça apenas rotação, corte e ampliação necessária.Fundos coloridos e impressão clara são mais difíceis de reconhecer.

A pré-visualização mostra a imagem que será realmente enviada ao OCR. Se a correção fizer os caracteres parecerem cortados, não execute; mude para outra correção. Os ajustes de imagem são mantidos para cada imagem selecionada.

Escolha o idioma e o layout de reconhecimento

Use “Português + English” para documentos mistos, “Português” para texto predominantemente em português e “English” para materiais em inglês. O modo automático atende à maioria dos documentos.

Acentos, cedilha e números devem sempre ser conferidos em nomes, valores, datas e códigos. Para melhor precisão, corte a imagem para uma área de leitura.

Mecanismo para converter tabelas e formulários em CSV/TSV para Excel

Usando a posição esquerda, largura, altura e número da linha de cada palavra retornada pelo mecanismo OCR, os limites de coluna são estimados onde há grandes espaços na mesma linha. Não é um método que restaura células a partir das linhas. Portanto, células vazias sem texto, células mescladas, células que abrangem várias linhas e caixas de seleção podem não corresponder à estrutura original da tabela.

CSV é salvo como arquivo; TSV é adequado para colar em Excel ou planilhas. Se as colunas estiverem desalinhadas, você pode editar as tabulações na aba de tabela antes de salvar. Ao importar valores e datas para uma planilha, verifique se separadores de milhar, sinal de menos, ponto decimal e era coincidem com a imagem original.

Ordem de verificação após OCR de formulários

  1. Se a correspondência entre linhas e colunas é mantida
  2. Verifique se 0 e O, 1 e I/l, 5 e S, 8 e B não foram trocados.
  3. Verifique se vírgulas, pontos decimais, hífens, parênteses e símbolos de moeda permanecem.
  4. Se o total e os valores dos itens conferem
  5. Verifique se campos vazios ou caixas de seleção não foram reconhecidos como texto por engano.

Como interpretar confiança e candidatos

A confiança média é um valor de referência de 0 a 100 que indica o quanto o mecanismo OCR avaliou cada palavra como provável. Esta ferramenta lista palavras com confiança abaixo de 70 como ‘candidatos de verificação’. Se a exibição de candidatos de verificação estiver ativada, você também pode ver a posição correspondente com um quadro vermelho na imagem.

Mesmo com alta confiança, pode haver erros de reconhecimento para outros caracteres plausíveis no contexto. Em particular, valores, números de conta, telefones, endereços, datas, números de fatura, números de registro, números de modelo de produto e nomes de pessoas e empresas devem ser sempre verificados com o original, independentemente da confiança. Por outro lado, caracteres decorativos e nomes próprios podem ter baixa confiança mesmo quando reconhecidos corretamente.

Ao transcrever várias imagens de uma vez

Você pode selecionar até 20 imagens, 20 MB cada, total de 150 MB. ‘Transcrever todas’ processa uma a uma na ordem exibida na tela. Como o OCR usa CPU e memória do dispositivo, a execução é sequencial, não paralela, para reduzir a carga.

Os resultados são mantidos por imagem. Ao selecionar novamente na lista de imagens à esquerda, você alterna para o estado de correção, transcrição, formato de tabela e candidatos de verificação dessa imagem. Ao salvar TXT, todos os resultados são combinados em um único arquivo com o nome do arquivo como cabeçalho; ao salvar CSV/TSV, as quebras de página são incluídas.

Muitas imagens de alta resolução aumentam o uso de memória do navegador. Se estiver lento, divida em lotes de cerca de 5 imagens e feche outras abas pesadas. Pressionar o botão de cancelar encerra o OCR atual e mantém os resultados concluídos.

Organize o resultado sem perder a estrutura

Remova espaços nas bordas, una espaços repetidos, exclua linhas vazias ou junte linhas quebradas somente depois de conferir o layout original. Formulários e tabelas podem usar espaços para representar colunas.

O OCR é executado localmente no navegador

A imagem é decodificada, corrigida e reconhecida no seu dispositivo. O WiseChecker não envia a imagem nem o texto reconhecido a um servidor de OCR.

Tesseract.js, o núcleo WebAssembly e os dicionários de português e inglês são servidos pelo WiseChecker. Recarregar a página limpa a lista atual.

O que o OCR não consegue ler com precisão

Esta ferramenta é destinada a texto impresso. Ela não restaura com precisão escrita manual, fontes extremamente estilizadas, marcas d’água que se misturam ao fundo, imagens de câmeras de vigilância de baixa resolução ou caracteres perdidos por desfoque ou mosaico. Também não usa funções de IA generativa para inferir e preencher informações ilegíveis.

AlvoProblemas comunsTratamento
Texto manuscritoA forma dos caracteres não corresponde ao que foi aprendido, causando grandes erros.Não use o resultado como referência; uma pessoa deve verificar o original e digitar.
Tabela complexaNão é possível restaurar células mescladas, campos vazios, linhas e cabeçalhos em várias linhas.Reconheça em partes e organize a tabela no Excel.
Carimbos e selosOs caracteres sobrepostos ao texto ficam cortados.Use o original sem carimbo ou outra cópia.
Foto inclinadaDistorce em forma de trapézio, tornando linhas e larguras de caracteres irregulares.Tire a foto novamente com o documento e a câmera paralelos.
PDF em imagemArquivos PDF não podem ser selecionados neste campo de entrada.Converta as páginas necessárias em PNG ou JPEG e carregue.

Perguntas frequentes sobre OCR de imagens e transcrição de formulários

As imagens e os resultados do reconhecimento são enviados para fora?

Não enviamos nada. O processamento de imagem, OCR e geração de resultados ocorrem no navegador, e o mecanismo e os dicionários são carregados do WiseChecker.

Quantas imagens posso transcrever gratuitamente?

Máximo de 20 imagens por vez, 20 MB cada, total de 150 MB. Não há limite de uso por registro, mas para evitar sobrecarga no dispositivo, divida grandes volumes de imagens.

Qual é a diferença entre “fotografar documento” e “selecionar imagem”?

‘Selecionar imagem’ carrega imagens salvas no dispositivo. ‘Fotografar documento’ é exibido apenas em smartphones e tablets compatíveis e é uma entrada para fotografar documentos com a câmera traseira. No PC, a opção de fotografia não funciona e se comporta como seleção de imagem, portanto o botão de fotografia não é exibido.

Por que a primeira inicialização demora?

Isso ocorre porque o mecanismo OCR e os dicionários do idioma selecionado são carregados no dispositivo. No mesmo navegador, eles são armazenados em cache, o que pode reduzir o tempo de carregamento nas próximas vezes.

Você consegue ler formulários manuscritos ou pesquisas?

Destinado a texto impresso; a precisão para manuscrito não é garantida. Reconheça apenas os nomes dos campos e verifique o conteúdo preenchido manualmente.

É possível converter a tabela para o mesmo layout do Excel original?

As colunas são estimadas a partir do espaçamento dos caracteres, mas linhas, células mescladas, células vazias, larguras de coluna e formatação não são restauradas. Abra o CSV/TSV no Excel e ajuste comparando com o original.

Posso usar valores e números de conta diretamente no trabalho?

Os resultados do OCR podem conter erros. Para informações importantes como valores, números de conta, datas e números de registro, confira sempre com o original, independentemente da confiança.

Por que não posso selecionar HEIC ou PDF?

Limitado a JPEG, PNG, WebP e BMP, que podem ser convertidos de forma estável entre navegadores. Para fotos do iPhone, fotografe ou exporte em formato compatível com JPEG ou converta a imagem antes de selecionar.

O que fazer se a imagem ficar preta ou o texto desaparecer?

Volte a correção para ‘Escala de cinza e contraste’ ou ‘Sem correção’ e verifique se a inversão de preto e branco não está ativada por engano.

Você pode interromper o processamento no meio?

Você pode pressionar ‘Cancelar processamento’ durante o processo. Isso encerra o mecanismo OCR atual e mantém apenas os resultados já concluídos.

Ferramentas gratuitas relacionadas