1Încărcaţi scanarea PDF documents; o scanare curăţată 300 DPI scară de gris devine cel mai bun recunoaştedor cu care să lucreze.
2Spune-i care limba de aşteptat — numirea limbii bate la un nivel larg.
3Executați pasul de recunoaștere; cuvintele sunt scrise înapoi ca un strat invizibil care stătea peste imaginea de pagina originală.
4Descarcă fișierul de căutare PDF — arată identic, dar acum puteți căuta și selecta textul din ea.
PDF OCR Întrebări
Cum se transformă OCR PDF o scanare în text?
+
În mod concret, fiecare pagină este dezvoltată, rulați printr-un text-recogniție Teseract trece în peste 100 de limbi, iar cuvintele recunoscute sunt scrise înapoi ca un strat de text invizibile poziționat peste imaginea originală — astfel încât pagina arata nemodificat, dar este în căutare și selectabil. Pagina arată exact cum a făcut - textul recunoscut se află în spatele imaginei, astfel încât să lucreze în căutare și selecție fără a schimba aspectul.
Ce limbi poate recunoaşte?
+
Peste 100, inclusiv latin, cirilic, grec, arabă, ebraică, chineză, japoneză, coreeană și script-urile indice. Spune-i care limba să se așteapte îmbunătățește material precizie, lașind-o să ghicească.
Formatul sursă afectează recunoașterea?
+
Acesta face. PDF corectează pagina: fonturi, vectori, imagini raster și coordonate text sunt înghețate astfel încât fiecare cititor vede layout identic. Cum pagina este stocat decide cu ce informații de rezoluție și culoare trebuie să lucreze.
Ceva specific la PDF aici?
+
Da, un PDF este un grafic de obiect, nu o imagine de pagină, astfel încât textul rămâne selectabil și vectorii rămân ascuțiți indiferent ce se întâmplă cu conținutul raster din interiorul acestuia. Afectează ceea ce poate vedea recunoaştetorul.
Cât de corect este?
+
Pe o scanare curată 300 DPI de text tipărit, suficient de mare că erorile sunt rare și în principal în substanți neobișnuiți. Precizia cade brusc cu rezoluție scăzută, skew, umbre de la o cameră de telefon, tipefoane neobișnuite și scrisul de mână — în special scrisul de mână nu este pentru ce este acest lucru.
La ce ar trebui să scanez pentru cel mai bun rezultat?
+
300 DPI în scala de gris este spot dulce. Sub 200 DPI forme de caracter începe de rupere în jos; peste 400 DPI câștigi aproape nimic și plătește pentru el în dimensiunea fișierului și timpul de procesare.
Ce pot încărca pe OCR PDF?
+
Orice PDF standard, inclusiv cele produse de un scaner, de un procesor de cuvinte sau de un driver de tipărire. Fișiere cu o parolă proprietară care restricționează ediția sunt gestionate; fișierele care au nevoie de o parolă de utilizator pentru a deschide nu sunt, și noi nu încercăm să rupe criptarea.
Există o limită de dimensiune a fișierului pe OCR PDF?
+
Da: documente de proces de conturi gratuite până la 5 MB fiecare, care acoperă majoritatea rapoartelor și contractelor, dar nu un document scanat lung la 600 DPI; Ghostscript și qpdf fac lucrarea. PDF-urile scanate sunt lucrul obișnuit care o depășește, și comprimarea documentului mai întâi este de obicei suficient pentru a-l aduce înapoi în jos.
OCR PDF va reduce calitatea PDF documents?
+
Text și vector de artă sunt obiecte mai degrabă decât pixeli, astfel încât acestea rămân perfect ascuțite la orice zoom indiferent de ce se întâmplă. Doar imaginile încorporate pot degrada, și doar dacă operația alegeți le reeșantionează.
Pot să conduc OCR PDF pe mai multe PDF documents de o dată?
+
Da — încărcă setul și procesează în paralel, sub un set de set de seturi, care este punctul de a face un flux de lucru document aici, în loc de a face clic pe un cititor de desktop.
Setatele, link-urile și câmpurile de formular supraviețuiesc?
+
Contururile, legăturile interne și anotațiile sunt păstrate oriunde operația permite. Semnele digitale sunt excepția: orice modificare a fișierului invalidează neapărat o semnătură, deoarece este exact pentru care este o semnătură.
OCR PDF costă ceva?
+
Nu OCR PDF este liber fără cont, și nimic nu este ștampilat pe pagini. Documentele încărcate sunt șterse de la lucrătorii la scurt timp după finalizarea postului.
Sau așteptați — următoarea conversie liberă deblocare în 00:00:00
Fișierul este prea mare
Acest fișier este mai mare decât limita de dimensiune gratuită pentru acest tip de fișier. Obține un pas pentru a-l converti, și fișiere mult mai mari, chiar acum.