1Hladdu inn skannaðri PDF documents; hreinn 300 DPI gráskali gefur þekkjaranum mest til að vinna með.
2Segðu henni hvaða tungumál á að búast við - að nefna tungumálið slær að láta það giska með breiðum framlögum.
3Keyrðu viðurkenningu yfirferð; orð eru skrifuð aftur sem ósýnilegt lag situr yfir upprunalegu síðu mynd.
4Sækja leitarhæfa PDF skrána - hún lítur út eins og hún er, en þú getur nú leitað og valið textann í henni.
PDF OCR Algengar spurningar
Hvernig breytir OCR PDF skönnun í texta?
+
Concretely, Hver síða er gerð, keyrir í gegnum Tesseract textagreiningu á yfir 100 tungumálum og viðurkennd orð eru skrifuð aftur sem ósýnilegt textalag sem er staðsett yfir upprunalegu myndina - þannig að síðuna lítur óbreytt en er leitað og valið. The page still looks exactly as it did — the recognised text sits invisibly behind the image so search and selection work without changing the appearance.
Hvaða tungumál getur það þekkt?
+
Yfir 100, þar á meðal latínu, kýrillísku, grísku, arabísku, hebresku, kínversku, japönsku, kóresku og Indversku handrit.Segja það hvaða tungumál að búast við bætir nákvæmni yfir að láta það giska.
Hefur upprunalega sniðið áhrif á viðurkenningu?
+
Það gerir það. PDF lagar síðuna: leturgerðir, vigrar, raster myndir og textahnit eru fryst þannig að hver lesandi sér sömu skipulag. Hvernig síðunni er vistað ræður því hvaða upplausn og litaupplýsingar myndgreinirinn þarf að vinna með.
Eitthvað sérstakt fyrir PDF hér?
+
Já — PDF er hlutgraf, ekki síðumynd, þannig að textinn er áfram valhæfur og vigrar eru skarpir sama hvað gerist við raster efni inni í honum. Það hefur áhrif á það sem viðurkennandinn getur séð.
Hversu nákvæm er það?
+
Á hreinum 300 DPI skönnun af prentuðu texta, nógu hátt að villur eru sjaldgæfar og aðallega í óvenjulegum eiginnöfnum.Náttfræði fellur niður skarpt með lágu upplausn, skekkju, skugga frá síma myndavél, óvenjuleg leturgerðir og handskrift - handskrift sérstaklega er ekki það sem þetta er fyrir.
Hvað ætti ég að skanna á fyrir bestu niðurstöðu?
+
300 DPI í gráskali er sætur blettur. Undir 200 DPI byrja stafform að brjótast niður; yfir 400 DPI færðu nánast ekkert og greiðir fyrir það í skráarstærð og vinnslutíma.
Hvað get ég hlaðið upp á OCR PDF?
+
Öll venjuleg PDF skjöl, þar á meðal þau sem eru búin til með skanna, ritvinnsluforriti eða prentara. Skrár með lykilorð eiganda sem takmarkar aðeins breytingar eru meðhöndlaðar. Skrár sem þurfa lykilorð notanda til að opna eru ekki meðhöndlaðar og við reynum ekki að brjóta dulkóðunina.
Er takmörk á stærð skráa á OCR PDF?
+
Já: Ókeypis reikningar vinna skjöl allt að 5 MB hver, sem nær yfir flestar skýrslur og samninga en ekki langt skannað skjal í 600 DPI; Ghostscript og qpdf gera verkið.Skannaðir PDF-skjöl eru venjulega það sem fer yfir það og þjappa skjalinu fyrst er venjulega nóg til að koma því aftur undir.
Mun OCR PDF lækka gæði PDF documents míns?
+
Texti og vektormyndir eru hlutir frekar en punktar, þannig að þær eru fullkomlega skarpar við hvaða aðdráttarstærð sem er, sama hvað gerist. Aðeins innbyggðar rastermyndir geta minnkað, og aðeins ef aðgerðin sem þú valdir endursýnir þær.
Get ég keyrt OCR PDF á nokkrum PDF documents í einu?
+
Já — hlaða upp settinu og þau vinna samhliða undir einni stillingu, sem er tilgangurinn með því að gera skjal vinnuflæði hér frekar en að smella í gegnum skjáborðslesara.
Lifa bókamerki, tenglar og eyðublöð af?
+
Útlínur, innri tenglar og athugasemdir eru varðveittar þar sem aðgerðin leyfir það. Tölvuundirskriftir eru undantekningin: allar breytingar á skránni ógilda undirskrift, því það er nákvæmlega það sem undirskriftin er til.
Kostar OCR PDF eitthvað?
+
Nr. OCR PDF er ókeypis án reiknings og ekkert er stimplað á síðurnar. Hleð inn skjölum er eytt úr starfsmönnum skömmu eftir að verkinu er lokið.