1Téléchargez le scan PDF documents; un scan à échelle grise de 300 DPI propre donne au reconnu le plus à travailler avec.
2Dites-lui quelle langue vous pouvez attendre — en donnant le nom de la langue, vous la laissez deviner par une large marge.
3Exécutez le passe de reconnaissance; les mots sont réécrits comme une couche invisible assise sur l'image de page originale.
4Télécharger le fichier de recherche PDF — il semble identique, mais vous pouvez maintenant rechercher et sélectionner le texte dans celui-ci.
OCR PDF FAQ
Comment OCR PDF transforme-t-il un scan en texte?
+
Concrètement, chaque page est rendue, passe par un passage de reconnaissance texte Tesseract dans plus de 100 langues, et les mots reconnus sont réécrits comme une couche de texte invisible positionnée sur l'image originale.. La page ressemble toujours exactement à elle — le texte reconnu se trouve invisiblement derrière l'image ainsi la recherche et la sélection fonctionnent sans changer l'apparence.
Quelles langues peut-elle reconnaître?
+
Plus de 100, y compris le latin, le cyrillique, le grec, l'arabe, l'hébreu, le chinois, le japonais, le coréen et les scripts Indic.
Le format source a-t-il une incidence sur la reconnaissance?
+
Il le fait. PDF corrige la page : polices, vecteurs, images raster et coordonnées de texte sont gelés afin que chaque lecteur voit la mise en page identique. Comment la page est stockée décide avec quelle résolution et quelle couleur l'information du reconnu doit fonctionner.
Quelque chose de spécifique à PDF ici?
+
Oui — un PDF est un graphique objet, pas une image de page, donc le texte reste sélectionnable et les vecteurs restent pointus, peu importe ce qui arrive au contenu raster à l'intérieur. Cela affecte ce que le reconnu peut voir.
C'est exact?
+
Sur un scan propre 300 DPI de texte imprimé, assez élevé que les erreurs sont rares et principalement dans des noms propres inhabituels. L'exactitude tombe brusquement avec une basse résolution, skew, ombres d'une caméra de téléphone, caractères et écritures inhabituelles — l'écriture en particulier n'est pas ce que cela est pour.
Que dois-je scanner pour obtenir le meilleur résultat?
+
300 DPI en échelle grise est le spot doux. En dessous de 200 DPI formes de caractères commencent à se décomposer; au-dessus de 400 DPI vous gagnez presque rien et payez pour elle dans la taille du fichier et le temps de traitement.
Que puis-je télécharger sur OCR PDF?
+
Tout PDF standard, y compris ceux produits par un scanner, par un processeur de texte ou par un pilote d'impression. Les fichiers avec un mot de passe propriétaire qui limite uniquement l'édition sont traités; les fichiers qui ont besoin d'un mot de passe utilisateur pour ouvrir ne sont pas, et nous ne essayons pas de briser le chiffrement.
Y a-t-il une limite de taille de fichier sur OCR PDF?
+
Oui : les comptes libres traitent les documents jusqu'à 5 MB chacun, qui couvre la plupart des rapports et des contrats mais pas un long document scanné à 600 DPI; Ghostscript et qpdf font le travail. Les PDF numérisés sont la chose habituelle qui dépasse le document, et la compression du document d'abord suffit normalement pour le ramener sous.
Est-ce que OCR PDF va diminuer la qualité de mon PDF documents?
+
Les œuvres texte et vectoriel sont des objets plutôt que des pixels, donc ils restent parfaitement pointus à n'importe quel zoom, peu importe ce qui se passe. Seules les images raster intégrées peuvent se dégrader, et seulement si l'opération que vous avez choisie les résample.
Puis-je lancer OCR PDF sur plusieurs PDF documents en même temps?
+
Oui — uploadez le jeu et ils le traitent en parallèle sous un seul jeu de paramètres, ce qui est le point de faire un workflow de document ici plutôt que de cliquer sur un lecteur de bureau.
Les signets, les liens et les champs de formation survivent-ils?
+
Les lignes directrices, les liens internes et les annotations sont conservés partout où l'opération le permet. Les signatures numériques sont l'exception : toute modification du fichier invalide nécessairement une signature, car c'est précisément pour cela qu'une signature est signée.
Est-ce que OCR PDF coûte quelque chose?
+
Non. OCR PDF est gratuit sans compte, et rien n'est inscrit sur les pages. Les documents téléchargés sont supprimés des travailleurs peu après la fin du travail.
Ou attendez — votre prochaine conversion libre se déverrouille dans 00:00:00
Fichier trop volumineux
Ce fichier est plus grand que la limite de taille gratuite pour ce type de fichier. Obtenez un passage pour le convertir, et des fichiers beaucoup plus grands, en ce moment.
Convertissez-le dès maintenant avec un laissez-passer de 24 heures :
🔒 Renouveller chaque semaine · Annuler à tout moment · Achat sécurisé