Herramienta de OCR y transcripción de imágenes | Exporta tablas y formularios a CSV y TSV

OCR en español e inglés en el dispositivoTexto impreso, recibos, formularios y tablasProcesa varias imágenes en secuenciaSin registro ni instalación

Elegir la imagen a leer

Ajusta el procesamiento de imagen, la dirección del texto y la disposición del texto según el propósito.

Elegir imagen

Arrastra la imagen aquíJPEG, PNG, WebP, BMP, hasta 20 archivos
Prioriza la cámara trasera del dispositivo para fotografiar el documento en el lugar.
Aún no se ha seleccionado ninguna imagen.

Configuración de reconocimiento

Ajustar rotación, inclinación y recorte
Margen a recortar (porcentaje desde cada borde de la imagen)
Organizar el texto reconocido

Imagen y resultado de OCR

Puedes ver el estado después de la corrección al seleccionar una imagen.

0 / 0
La imagen se mostrará aquíCuanto más horizontal esté el texto y menos sombras y márgenes haya, más fácil será reconocerlo.
En espera0%

Las imágenes y los resultados de reconocimiento no se envían al servidor. El motor OCR y los diccionarios también se cargan desde WiseChecker.

Qué puede hacer esta herramienta de OCR

Extrae texto impreso en español, inglés y números de escaneos, fotos, recibos, formularios, etiquetas y tablas. Revisa el resultado, cópialo o guárdalo como TXT, CSV y TSV.

Las imágenes y el texto reconocido permanecen en el navegador. El motor y los diccionarios de español e inglés se sirven desde WiseChecker.

OCR en español e inglés

Reconoce párrafos, etiquetas, fechas, importes e identificadores.

Corrección de documentos

Ajusta grises, contraste, umbral, inversión y recorte.

Revisa baja confianza

Localiza palabras que deben compararse con la imagen original.

Exporta tablas

Estima columnas y guarda CSV o TSV para terminar la revisión.

Pasos para transcribir texto desde una imagen

  1. Seleccione el tipo de imagenElija el propósito más cercano: documentos, facturas/recibos, tablas/formularios o texto vertical.
  2. Cargar imagenEn PC puede usar selección de imagen, arrastrar y pegar. En teléfonos y tabletas compatibles, puede iniciar la cámara del dispositivo desde «Fotografiar documento».
  3. Ver la imagen corregidaAjusta la orientación, la inclinación, los márgenes y la intensidad del texto para que sea legible.
  4. Ejecutar transcripciónProcesa una sola imagen o todas las cargadas en orden. La primera vez requiere tiempo para cargar el motor OCR y el diccionario.
  5. Comparar candidatos de confirmación con la imagen originalVerifique especialmente las palabras con confianza inferior a 70, montos, fechas, números de artículo y nombres propios.
  6. Guardar en el formato adecuadoGuarde el texto como TXT y las tablas como CSV o TSV. También puede corregir en pantalla y luego copiar.

Configuración para leer facturas, recibos y formularios

Al seleccionar «Factura y recibo», se aplica un procesado en blanco y negro que reduce las variaciones de brillo y las sombras del papel, y se lee como una región continua. Si la fecha, el número de comprobante, el número de registro, el monto, la tasa de impuesto y el nombre del producto están separados, cambiar «Disposición de texto» a «Texto separado y elementos» puede mejorar.

En «Tabla y formulario» se conservan los espacios entre palabras y se estiman los límites de columna a partir de la posición horizontal de las palabras reconocidas. La pestaña de formato de tabla se muestra con separadores de tabulación y se puede pegar directamente en Excel. Al guardar CSV, los nombres de productos o montos que contengan comas se encierran entre comillas.

Tipo de imagenElegir uso primeroRevisar ajustesCaracteres a verificar especialmente
FacturaFacturas y recibosCorrección de sombras, caracteres y campos separadosNúmero de factura, número de registro, importe y tipo impositivo
ReciboFacturas y recibosRecorte de márgenes, corrección de inclinaciónFecha, cantidad, precio unitario, total y nombre de la tienda
Formularios y listas de verificaciónTablas y formulariosConservar espacios, blanco y negroCasillas de verificación, valores escritos, unidades y notas fuera de la tabla
Avisos y actasDocumentos y avisosDetección automática de párrafos, corrección de grisesNombres propios, fechas, URL y direcciones de correo electrónico

Cómo tomar imágenes para mejorar la precisión del reconocimiento de caracteres

La precisión del OCR depende del tamaño de los caracteres, el enfoque, la inclinación, las sombras, el fondo y la compresión. En teléfonos inteligentes, mantenga el documento y la cámara paralelos y coloque las cuatro esquinas dentro del encuadre. Si la iluminación cenital se refleja fuertemente en el papel, cambie ligeramente el ángulo del dispositivo o de la luz.

  • Fotografíe con una resolución donde se vea el contorno de los caracteres y use el original en lugar de imágenes re-comprimidas en redes sociales o chats.
  • Para fotos con bordes oscuros, seleccione “Suprimir sombras y convertir a blanco y negro”.
  • Los escritorios o fondos que no son documentos se eliminan recortando los márgenes.
  • La rotación de 90 grados se corrige con los botones de rotación izquierda/derecha; la inclinación de unos pocos grados se corrige con la corrección de inclinación.
  • Aumente el contraste para impresiones tenues. Para caracteres borrosos, la conversión a blanco y negro puede ser contraproducente; compare también con la corrección en escala de grises.

Las imágenes pequeñas se amplían automáticamente. La ampliación no restaura información que no existe en la imagen original, pero ayuda a que el motor OCR analice el contorno de los caracteres a un tamaño adecuado. Si los caracteres se han perdido por baja resolución, movimiento o sobreexposición, volver a tomar la foto es lo más seguro.

Diferencias entre corrección de grises, blanco y negro y corrección de sombras

Corrección de imagenImagen adecuadaContenido del procesoSi no coincide
Escala de grises y corrección de contrasteEscaneos, documentos impresos y texto tenueConvierte el color en brillo y amplía las zonas oscuras y claras.Si la sombra del fondo es fuerte, la sombra también se conserva como texto.
Reducir sombras y convertir a blanco y negroFotografías tomadas con teléfono inteligente y recibosCompara con el brillo circundante y separa el texto en blanco y negro.Puede que desaparezcan sombreados, fotografías y líneas finas.
Blanco y negroFormularios con contraste claroCalcula el valor umbral de toda la imagen y la divide en blanco y negro.Si la iluminación es desigual, algunos caracteres pueden perderse.
Sin ajusteEscaneo ya nítidoSolo se realizan rotación, recorte y el aumento necesario.Los fondos de color y la impresión tenue son difíciles de reconocer.

La vista previa muestra la imagen que realmente se pasa al OCR. Si la corrección hace que los caracteres se vean incompletos, no ejecute así; cambie a otra corrección. Los ajustes de imagen se conservan para cada imagen seleccionada.

Elige el idioma y el diseño de reconocimiento

Usa “Español + English” para documentos mixtos, “Español” para texto principalmente en español y “English” para materiales en inglés. El diseño automático sirve para la mayoría de documentos.

Comprueba tildes, eñes, cifras, nombres, importes y códigos. Recorta la imagen a una zona de lectura para mejorar la precisión.

Mecanismo para convertir tablas y formularios a CSV/TSV para Excel

Usa la posición izquierda, el ancho, la altura y el número de línea de cada palabra devuelta por el motor OCR, y estima los límites de columna donde hay grandes espacios en la misma línea. No es un método que restaure celdas a partir de las líneas. Por lo tanto, los espacios vacíos sin texto, celdas combinadas, celdas que abarcan varias líneas y casillas de verificación pueden no coincidir con la estructura original de la tabla.

CSV se guarda como archivo y TSV es adecuado para pegar en Excel u hojas de cálculo. Si las columnas se desalinean, puede editar las tabulaciones en la pestaña de formato de tabla antes de guardar. Al importar montos o fechas a una hoja de cálculo, verifique que los separadores de miles, signos negativos, decimales y eras coincidan con la imagen original.

Orden de revisión después del OCR de formularios

  1. Si se mantiene la correspondencia entre filas y columnas
  2. ¿Se han intercambiado 0 y O, 1 e I/l, 5 y S, 8 y B?
  3. ¿Quedan comas, puntos decimales, guiones, paréntesis y símbolos de moneda?
  4. Si el cálculo del total y el de los detalles coinciden
  5. ¿Se han reconocido erróneamente espacios en blanco o casillas de verificación como texto?

Cómo ver la confianza y las alternativas

La confianza promedio es un valor de referencia de 0 a 100 que indica cuán probable considera el motor OCR cada palabra. Esta herramienta lista las palabras con confianza inferior a 70 como «candidatos de verificación». Si la visualización de candidatos está activada, también puede ver la posición correspondiente con un recuadro rojo en la imagen.

Incluso con alta confianza, puede haber errores de reconocimiento a otras palabras plausibles en el contexto. Especialmente montos, números de cuenta, números de teléfono, direcciones, fechas, números de factura, números de registro, números de modelo de producto y nombres de personas o empresas deben verificarse siempre con el original, no solo con la confianza. Por el contrario, los caracteres decorativos o nombres propios pueden tener baja confianza incluso si se reconocen correctamente.

Al transcribir varias imágenes a la vez

Puede seleccionar hasta 20 imágenes, 20 MB por imagen y 150 MB en total. «Reconocer todo» procesa una por una en el orden en pantalla. El OCR usa la CPU y la memoria del dispositivo, por lo que se ejecuta secuencialmente, no en paralelo, para reducir la carga.

Los resultados se conservan por imagen. Al seleccionar de nuevo en la lista de imágenes de la izquierda, cambia a la corrección, el resultado de reconocimiento, el formato de tabla y los candidatos de verificación de esa imagen. Al guardar TXT, se combinan todas las imágenes en un solo archivo con el nombre de archivo como encabezado; al guardar CSV/TSV, se incluyen los separadores de página.

Con muchas imágenes de alta resolución, el uso de memoria del navegador aumenta. Si va lento, divida en lotes de unas 5 imágenes y cierre otras pestañas pesadas. Al pulsar el botón de cancelar, finaliza el OCR actual y conserva los resultados completados.

Limpia el resultado sin perder la estructura

Recorta espacios de los bordes, agrupa espacios repetidos, elimina líneas vacías o une líneas partidas solo después de revisar el diseño original. Formularios y tablas pueden usar espacios para representar columnas.

El OCR se ejecuta localmente en el navegador

La imagen se decodifica, corrige y reconoce en tu dispositivo. WiseChecker no envía la imagen ni el texto reconocido a un servidor de OCR.

Tesseract.js, el núcleo WebAssembly y los diccionarios de español e inglés se sirven desde WiseChecker. Recargar la página borra la lista actual.

Elementos que el OCR no puede leer con precisión

Esta herramienta está orientada a texto impreso. No restaura con precisión escritura manual, tipografías extremadamente estilizadas, marcas de agua que se funden con el fondo, imágenes de cámaras de vigilancia de baja resolución, ni caracteres perdidos por desenfoque o mosaico. Tampoco utiliza funciones de IA generativa que adivinen información no legible en la imagen.

ObjetivoProblemas comunesAcción
Texto manuscritoLa forma de los caracteres no coincide con el objeto de aprendizaje y se producen grandes errores de reconocimiento.No se base en el resultado; una persona verifica el original e ingresa los datos.
Tabla complejaNo se pueden restaurar celdas combinadas, espacios en blanco, líneas de cuadrícula ni encabezados de varios niveles.Reconoce por rangos y organiza la tabla en Excel.
Sellos y estampillasLos caracteres superpuestos al texto principal se pierden.Utilice el original sin sello o una copia diferente.
Foto inclinadaSe deforma en forma trapezoidal y las líneas y el ancho de los caracteres se vuelven desiguales.Vuelva a tomar la foto con el documento y la cámara paralelos.
PDF dentro de imagenLos archivos PDF no se pueden seleccionar en este campo de entrada.Cargue las páginas necesarias como PNG o JPEG.

Preguntas frecuentes sobre OCR de imágenes y transcripción de formularios

¿Se envían las imágenes y los resultados de reconocimiento a servidores externos?

No se envía nada. El procesamiento de imagen, OCR y generación de resultados se realiza en el navegador; el motor y los diccionarios también se cargan desde WiseChecker.

¿Cuántas imágenes puedo transcribir gratis?

Máximo 20 imágenes, 20 MB por imagen y 150 MB en total. No hay límite de uso registrado, pero para evitar la carga del dispositivo, divida las imágenes grandes.

¿Cuál es la diferencia entre “fotografiar un documento” y “seleccionar una imagen”?

«Seleccionar imagen» carga imágenes guardadas en el dispositivo. «Fotografiar documento» solo se muestra en teléfonos y tabletas compatibles y es una entrada para fotografiar el documento en el lugar con la cámara trasera. En PC, la especificación de fotografía no funciona y se comporta igual que la selección de imagen, por lo que no se muestra el botón de fotografía.

¿Por qué tarda tanto la primera vez?

Es para cargar el motor OCR y el diccionario del idioma seleccionado en el dispositivo. En el mismo navegador se almacenan en caché y la carga posterior puede ser más rápida.

¿Puede leer formularios de solicitud y encuestas escritos a mano?

Está orientado a texto impreso, por lo que no se garantiza la precisión en escritura manual. Reconozca solo los nombres de los campos y revise el contenido escrito manualmente.

¿Se puede convertir la tabla al mismo diseño de Excel que el original?

Estima las columnas a partir del espaciado de los caracteres, pero no restaura líneas, celdas combinadas, espacios vacíos, ancho de columna ni formato. Abra el CSV/TSV en Excel y ajústelo comparando con el original.

¿Puedo usar montos y números de cuenta directamente en el trabajo?

Los resultados de OCR pueden contener errores. Para información importante como montos, números de cuenta, fechas y números de registro, verifique siempre con el original, independientemente de la confianza.

¿Por qué no puedo seleccionar HEIC o PDF?

Se limita a JPEG, PNG, WebP y BMP, que se pueden convertir a imagen de forma estable entre navegadores. Las fotos de iPhone deben tomarse o exportarse en formato compatible con JPEG, o convertirse a imagen antes de seleccionarlas.

¿Qué hago si la imagen se oscurece o el texto desaparece?

Vuelva a la corrección «Escala de grises y contraste» o «Sin corrección» y verifique que la inversión de blanco y negro no esté activada por error.

¿Puedo detener el proceso a mitad de camino?

Puede pulsar «Cancelar procesamiento» durante el proceso. Finaliza el motor OCR actual y conserva solo los resultados de imágenes ya completadas.

Herramientas gratuitas relacionadas