1Feltölti a beszkennelt PDF documents; egy tiszta 300 dpi szürke skála vizsgálat adja a felismerő a legtöbbet dolgozni.
2Mondd meg neki, melyik nyelven várhatja el, hogy a nyelv neve jobb, ha széles sávban találgat.
3Futtasd le a felismerő hágót; a szavakat láthatatlan rétegként írták vissza, amely az eredeti oldal képén ül.
4Töltse le a kereshető PDF fájlt ~ azonosnak tűnik, de most már kereshet és kiválaszthatja a benne lévő szöveget.
OCR PDF GYIK
Hogyan alakítja a OCR PDF egy szkenn-t szövegté?
+
Konkrétan, minden oldalt lefordítunk, végigfutunk egy Tesseract szövegfelismerő pass-on több mint 100 nyelven, és az elismert szavakat visszaírjuk láthatatlan szövegrétegként, amely az eredeti képre helyezkedik ~ így az oldal változatlannak tűnik, de kereshető és választható. Az oldal még mindig pontosan úgy néz ki, mint ~ az elismert szöveg láthatatlanul a kép mögött ül, így a keresés és kiválasztás a megjelenés megváltoztatása nélkül működik.
Milyen nyelveket ismer fel?
+
Több mint 100, beleértve a latin, cirill, görög, arab, héber, kínai, japán, koreai és az indic szkripteket. Elmondja, hogy melyik nyelv számít lényegesen javítja a pontosságot, mint hogy kitalálja.
A forrásformátum befolyásolja az elismerést?
+
Így van. PDF rögzíti az oldalt: betűtípusok, vektorok, raszter képek és szövegkoordináták fagyott, így minden olvasó látja azonos elrendezés. Az oldal tárolásának módja határozza meg, hogy az felismerőnek milyen felbontási és színinformációkkal kell működnie.
Van valami konkrét PDF-re?
+
Igen, A PDF egy objektum grafikon, nem egy oldalkép, így a szöveg marad kiválasztható és vektorok marad éles nem számít, mi történik a raszter tartalom benne. Ez befolyásolja, amit a felismerő lát.
Mennyire pontos?
+
A tiszta 300 DPI-s letapogatáson a nyomtatott szöveg, elég magas, hogy hibák ritkák és többnyire szokatlan megfelelő főnevek. Pontosság esik le élesen alacsony felbontású, skew, árnyékok egy telefon kamera, szokatlan betűk és kézírás ~ kézírás különösen nem ez az, amire ez.
Mit kell beszkennelni a legjobb eredmény?
+
300 dpi szürkeárnyalatban az édes folt. 200 dpi karakteralak alatt kezd lebontani; 400 dpi felett szinte semmit sem nyersz és fizetsz érte a fájlméretben és a feldolgozásban.
Mit tölthetek fel a OCR PDF - ra?
+
Bármilyen szabványos PDF, beleértve a szkenner által gyártottakat, egy szóprocesszor vagy egy nyomtató meghajtó. A tulajdonos jelszavával rendelkező fájlok, amelyek csak korlátozzák a szerkesztést, nem kerülnek feldolgozásra; olyan fájlok, amelyek megnyitásához felhasználó jelszóra van szükség, és nem próbálunk meg feltörni titkosítást.
Van-e fájlméret-határ a OCR PDF-on?
+
Igen: ingyenes számlafolyamatok dokumentumok 5 MB minden, amely kiterjed a legtöbb jelentések és szerződések, de nem egy hosszú beszkennelt dokumentum 600 DPI; Ghostscript és qpdf csinálni a munkát. A letapogatott PDF-ek a szokásosak, amik meghaladják azt, és a dokumentum első tömörítése általában elég ahhoz, hogy visszahozzuk.
A OCR PDF csökkenti a PDF documents-em minőségét?
+
A szöveg és a vektorok a képpontok helyett tárgyak, így minden zoomnál tökéletesen élesek maradnak, bármi történjék is. Csak a beágyazott raszterképek bomlanak le, és csak akkor, ha a művelet, amit választottál, újramintazi őket.
Lefuttathatom a OCR PDF-t egyszerre több PDF documents-en is?
+
Igen • töltse fel a készletet, és párhuzamosan egy beállítási csomagban is feldolgozzák, ami a dokumentum munkafolyamatának a lényege, ahelyett, hogy egy asztali olvasón keresztül kattintana.
Túléli-e a könyvjelzők, linkek és alakzatok?
+
A külső vonalak, belső linkek és megjegyzések ott maradnak meg, ahol a művelet lehetővé teszi. A digitális aláírások kivétel: a fájl bármely módosítása szükségszerűen érvényteleníti az aláírást, mert pontosan erre szolgál az aláírás.
OCR PDF kerül bármibe is?
+
Nem. OCR PDF ingyenes fiók nélkül, és semmi sincs bélyegezve az oldalakra. Feltöltött dokumentumok törölve a dolgozók röviddel a munka befejezése után.