1Sube el PDF documents escaneado; un escaneo de escala de grises limpio de 300 DPI le da al reconocidor el máximo con el que trabajar.
2Dile qué idioma esperar — nombrar el idioma late dejando que adivine por un amplio margen.
3Ejecute el pase de reconocimiento; las palabras se escriben de nuevo como una capa invisible sentada sobre la imagen original de la página.
4Descargue el archivo PDF que puede buscarse, pero ahora puede buscar y seleccionar el texto que contiene.
PDF con reconocimiento óptico de caracteres Preguntas frecuentes
¿Cómo OCR PDF convierte un escaneo en texto?
+
Concretamente, cada página se representa, se ejecuta a través de un pase de reconocimiento de texto Tesseract en más de 100 idiomas, y las palabras reconocidas se escriben de nuevo como una capa de texto invisible posicionada sobre la imagen original — por lo que la página parece sin cambios pero es buscable y seleccionable. La página todavía se ve exactamente como lo hizo — el texto reconocido se encuentra invisiblemente detrás de la imagen así que la búsqueda y selección de trabajo sin cambiar la apariencia.
¿Qué idiomas puede reconocer?
+
Más de 100, incluyendo latín, cirílico, griego, árabe, hebreo, chino, japonés, coreano y las escrituras índicas. Diciéndole qué idioma esperar mejora materialmente la precisión sobre dejar que adivine.
¿El formato de origen afecta el reconocimiento?
+
Lo hace. PDF corrige la página: fuentes, vectores, imágenes de raster y coordenadas de texto se congelan para que cada lector vea la distribución idéntica. Cómo se almacena la página decide con qué resolución y color tiene que trabajar el reconocidor.
¿Algo específico para PDF aquí?
+
Sí — un PDF es un gráfico de objetos, no una imagen de página, por lo que el texto permanece seleccionable y los vectores permanecen en forma aguda sin importar lo que pase con el contenido de raster dentro de él. Afecta lo que el reconocidor puede ver.
¿Qué tan exacto es?
+
En un escaneo limpio de 300 DPI de texto impreso, lo suficientemente alto como para que los errores sean raros y sobre todo en sustantivos apropiados inusuales. La precisión se desconecta bruscamente con baja resolución, sesgo, sombras de una cámara telefónica, tipografías inusuales y escritura a mano — la escritura a mano en particular no es para lo que esto es.
¿En qué debería buscar el mejor resultado?
+
300 DPI en escala de grises es el punto dulce. Por debajo de 200 DPI de caracteres de formas comienzan a descomponerse; por encima de 400 DPI usted gana casi nada y paga por él en tamaño de archivo y tiempo de procesamiento.
¿Qué puedo subir a OCR PDF?
+
Cualquier PDF estándar, incluyendo los producidos por un escáner, por un procesador de textos o por un controlador de impresión. Los archivos con una contraseña de propietario que sólo restringe la edición se manejan; los archivos que necesitan una contraseña de usuario para abrir no lo son, y no intentamos romper el cifrado.
¿Hay un límite de tamaño de archivo en OCR PDF?
+
Sí: cuentas libres procesan documentos hasta 5 MB cada uno, que cubre la mayoría de los informes y contratos, pero no un documento escaneado largo en 600 DPI; Ghostscript y qpdf hacen el trabajo. Los PDF escaneados son lo habitual que lo supera, y comprimir el documento primero es normalmente suficiente para traerlo de vuelta debajo.
¿Bajará OCR PDF la calidad de mi PDF documents?
+
Texto y vector de arte son objetos en lugar de píxeles, por lo que permanecen perfectamente nítidos en cualquier zoom no importa lo que suceda. Sólo las imágenes de raster incrustadas pueden degradarse, y sólo si la operación que usted eligió los vuelve a muestrear.
¿Puedo ejecutar OCR PDF en varios PDF documents a la vez?
+
Sí — subir el conjunto y procesar en paralelo bajo un conjunto de ajustes, que es el punto de hacer un flujo de trabajo de documentos aquí en lugar de hacer clic a través de un lector de escritorio.
¿Sobreviven marcadores, enlaces y campos de forma?
+
Los esquejes, los enlaces internos y las anotaciones se conservan donde la operación lo permita. Las firmas digitales son la excepción: cualquier cambio en el archivo invalida necesariamente una firma, porque para eso es precisamente una firma.
¿Cuesta algo OCR PDF?
+
No. OCR PDF es gratis sin una cuenta, y nada se estampa en las páginas. Los documentos cargados se eliminan de los trabajadores poco después de que el trabajo se completa.
O espera: tu próxima conversión gratuita se desbloquea en 00:00:00
El archivo es demasiado grande
Este archivo es más grande que el límite de tamaño libre para este tipo de archivo. Obtenga un pase para convertirlo, y archivos mucho más grandes, ahora mismo.
Conviértalo ahora mismo con un pase de 24 horas:
🔒 Renueva semanalmente · Cancelar en cualquier momento · Pago seguro