1Upload de gescande PDF documents; een schone 300 dpi grijswaardenscan geeft de herkenner het meest om mee te werken.
2Vertel het welke taal te verwachten.. Het benoemen van de taal beter dan het laten raden door een brede marge.
3Voer de herkenningspas uit; de woorden worden teruggeschreven als een onzichtbare laag die over de oorspronkelijke pagina-afbeelding zit.
4Download het doorzoekbare PDF bestand. Het ziet er identiek uit, maar je kunt nu zoeken en de tekst erin selecteren.
OCR PDF Veelgestelde vragen
Hoe zet OCR PDF een scan om in tekst?
+
Concreet elke pagina wordt weergegeven, wordt uitgevoerd door een Tesseract tekstherkenningspas in meer dan 100 talen, en de herkende woorden worden teruggeschreven als een onzichtbare tekstlaag geplaatst over de oorspronkelijke afbeelding.. zodat de pagina er ongewijzigd uitziet, maar is doorzoekbaar en selecteerbaar. De pagina ziet er nog steeds precies uit zoals het deed.. De herkende tekst zit onzichtbaar achter de afbeelding dus zoeken en selectie werken zonder het uiterlijk te veranderen.
Welke talen kan het herkennen?
+
Meer dan 100, waaronder Latijn, Cyrillisch, Grieks, Arabisch, Hebreeuws, Chinees, Japans, Koreaans en de Indic scripts. Het vertellen van het welke taal te verwachten materieel verbetert nauwkeurigheid over het laten raden.
Heeft het bronformaat invloed op de herkenning?
+
Dat doet het. PDF herstelt de pagina: lettertypen, vectoren, rasterafbeeldingen en tekstcoördinaten worden bevroren zodat elke lezer dezelfde lay-out ziet. Hoe de pagina wordt opgeslagen bepaalt welke resolutie en kleurinformatie de herkenner moet gebruiken.
Iets specifieks voor PDF hier?
+
Ja. een PDF is een object grafiek, geen pagina afbeelding, dus tekst blijft selecteerbaar en vectoren blijven scherp, ongeacht wat er gebeurt met de raster inhoud erin. Het beïnvloedt wat de herkenner kan zien.
Hoe nauwkeurig is het?
+
Op een schone 300 DPI scan van gedrukte tekst, hoog genoeg dat fouten zeldzaam zijn en meestal in ongebruikelijke juiste zelfstandig naamwoorden. Nauwkeurigheid valt scherp af met lage resolutie, schuin, schaduwen van een telefooncamera, ongebruikelijke lettertypes en handschrift. handschrift in het bijzonder is niet waar dit voor is.
Waar moet ik op scannen voor het beste resultaat?
+
300 dpi in grijswaarden is de zoete plek. Onder 200 dpi karaktervormen beginnen te breken; boven 400 dpi krijg je bijna niets en betaal je ervoor in bestandsgrootte en verwerkingstijd.
Wat kan ik uploaden naar OCR PDF?
+
Standaard PDF, inclusief die welke door een scanner, een tekstverwerker of een afdrukstuurprogramma worden geproduceerd. Bestanden met een eigenaarwachtwoord dat alleen het bewerken beperkt worden behandeld; bestanden die een gebruikerswachtwoord nodig hebben om te openen zijn niet, en we proberen niet om encryptie te breken.
Is er een bestandsgroottelimiet op OCR PDF?
+
Ja: gratis accounts verwerken documenten tot 5 MB elk, die betrekking heeft op de meeste rapporten en contracten, maar niet een lang gescand document op 600 DPI; Ghostscript en qpdf doen het werk. Gescande PDF's zijn het gebruikelijke ding dat het overtreft, en het comprimeren van het document is normaal gesproken voldoende om het terug te brengen.
Zal OCR PDF de kwaliteit van mijn PDF documents verlagen?
+
Tekst en vectorkunst zijn objecten in plaats van pixels, dus ze blijven perfect scherp bij elke zoom, ongeacht wat er gebeurt. Alleen de ingebedde rasterafbeeldingen kunnen afbreken, en alleen als de operatie die je koos ze opnieuw neemt.
Kan ik OCR PDF op meerdere PDF documents tegelijk uitvoeren?
+
Ja. Upload de set en ze proces parallel onder een set van instellingen, dat is het punt van het doen van een document workflow hier in plaats van te klikken door een desktop lezer.
Overleven bladwijzers, links en vormvelden?
+
Uitlijningen, interne links en annotaties worden bewaard waar de operatie het toelaat. Digitale handtekeningen zijn de uitzondering: elke wijziging van het bestand maakt noodzakelijkerwijs een handtekening ongeldig, want dat is precies waar een handtekening voor is.
Heeft OCR PDF iets gekost?
+
No. OCR PDF is gratis zonder account en er wordt niets gestempeld op de pagina's. Geüploade documenten worden verwijderd van de werknemers kort nadat de taak is voltooid.