1Upload den scannede PDF documents; en ren 300 DPI gråskala scanning giver genkenderen mest at arbejde med.
2Fortæl det hvilket sprog der skal forventes! navngivning sproget slår lade det gætte med en bred margen.
3Kør anerkendelse pass; ordene er skrevet tilbage som et usynligt lag sidder over den oprindelige side billede.
4Hent den søgbare PDF fil ~ det ser identisk, men du kan nu søge og vælge teksten i det.
OCR PDF Ofte stillede spørgsmål
Hvordan laver OCR PDF en scanning til tekst?
+
Konkret, Hver side gengives, køres gennem en Tesseract tekst-anerkendelse pass på over 100 sprog, og de anerkendte ord er skrevet tilbage som en usynlig tekst lag placeret over det oprindelige billede! så siden ser uændret, men er søgbar og valgbar. Siden ser stadig ud præcis som det gjorde! den anerkendte tekst sidder usynligt bag billedet, så søgning og udvælgelse arbejde uden at ændre udseendet.
Hvilke sprog kan den genkende?
+
Over 100, herunder latin, kyrillisk, græsk, arabisk, hebraisk, kinesisk, japansk, koreansk og indisk manuskripter. Fortælle det hvilket sprog der kan forvente væsentligt forbedrer nøjagtigheden over at lade det gætte.
Har kildeformatet indflydelse på anerkendelsen?
+
Det gør det. PDF løser siden: skrifttyper, vektorer, rasterbilleder og tekstkoordinater er frosne, så hver læser ser identisk layout. Hvordan siden gemmes bestemmer hvilken opløsning og farve information genkenderen skal arbejde med.
Noget specifikt for PDF her?
+
Ja ~ en PDF er en objektgraf, ikke et sidebillede, så tekst forbliver valgbar og vektorer forbliver skarpe uanset hvad der sker med rasterindholdet i det. Det påvirker, hvad genkenderen kan se.
Hvor nøjagtigt er det?
+
På en ren 300 DPI scanning af trykt tekst, høj nok til, at fejl er sjældne og for det meste i usædvanlige rigtige navneord. Nøjagtighed falder ud kraftigt med lav opløsning, skæv, skygger fra et telefonkamera, usædvanlige skrifttyper og håndskrift! håndskrift i særdeleshed er ikke, hvad dette er for.
Hvad skal jeg scanne efter det bedste resultat?
+
300 DPI i gråskala er det søde sted. Nedenfor 200 DPI tegn figurer begynder at nedbrydes; over 400 DPI får du næsten intet og betaler for det i filstørrelse og behandlingstid.
Hvad kan jeg uploade til OCR PDF?
+
Enhver standard PDF, herunder dem, der produceres af en scanner, af en tekstbehandlingsprogram eller af en udskriftsdriver. Filer med en ejer adgangskode, der kun begrænser redigering håndteres; filer, der har brug for en bruger adgangskode til at åbne er ikke, og vi forsøger ikke at bryde kryptering.
Er der en filstørrelsesgrænse på OCR PDF?
+
Ja: gratis konti behandler dokumenter op til 5 MB hver, som dækker de fleste rapporter og kontrakter, men ikke en lang scannet dokument på 600 DPI; Ghostscript og qpdf gøre arbejdet. Scannede PDF-filer er det sædvanlige, der overstiger det, og komprimere dokumentet først er normalt nok til at bringe det tilbage under.
Vil OCR PDF sænke kvaliteten af min PDF documents?
+
Tekst og vektor- kunst er objekter snarere end pixels, så de forbliver perfekt skarpe ved enhver zoom uanset hvad der sker. Kun de indlejrede rasterbilleder kan nedbrydes, og kun hvis den operation du valgte omprøver dem.
Kan jeg køre OCR PDF på flere PDF documents på én gang?
+
Ja ! uploade sættet og de behandler parallelt under et sæt af indstillinger, hvilket er det punkt, at gøre et dokument workflow her i stedet for at klikke gennem en desktop læser.
Overlever bogmærker, links og danner felter?
+
Omrids, interne links og annotationer bevares, hvor operationen tillader det. Digitale signaturer er undtagelsen: Enhver ændring af filen ugyldiggør nødvendigvis en signatur, fordi det er præcis, hvad en signatur er for.
Koster OCR PDF noget?
+
Nej. OCR PDF er gratis uden en konto, og intet er stemplet på siderne. Uploadede dokumenter slettes fra arbejderne kort efter jobbet er færdig.