Plani i lirë: 1 konvertim/orë, 1 file në një kohë
Shko pa kufizim →

PDF me OCR

OCR në linjë PDF

Zgjidhni skedarët tuaj

*Skedarët fshihen pas 24 orësh

Konvertoni deri në 1 GB skedarë falas, përdoruesit Pro mund të konvertojnë deri në 100 GB skedarë; Regjistrohuni tani

Duke ngarkuar

0%

Si të OCR PDF

1 Ngarko PDF documents e skanuar; një skanim i pastër 300 DPI në gri-scale i jep njohësit më shumë për të punuar.
2 Thuaj atij se cila gjuhë të presë - emërimi i gjuhës mund të lejojë atë të gjejë me një kufi të gjerë.
3 Ekzekuto njohjen e fjalëve; fjalët shkruahen si një shtresë e padukshme mbi figurën origjinale të faqes.
4 Shkarko file PDF të kërkueshëm - duket identik, por tani mund të kërkosh dhe të zgjedhësh tekstin në të.

PDF me OCR Pyetje të shpeshta

Si e kthen OCR PDF një skanim në tekst?
+
Konkretisht, çdo faqe është paraqitur, kryhet nëpërmjet një njohjeje teksti Tesseract në më shumë se 100 gjuhë, dhe fjalët e njohura janë shkruar si një shtresë e padukshme teksti e vendosur mbi imazhin origjinal — kështu që faqe duket e pandryshuar por është e kërkueshme dhe e zgjedhshme. Faqja ende duket tamam siç ishte — teksti i njohur qëndron i padukshëm pas figurës kështu që kërkimi dhe zgjedhja punojnë pa ndryshuar pamjen.
Mbi 100, duke përfshirë latinisht, cirilik, greqisht, arabisht, hebraisht, kinezisht, japonezisht, koreanisht dhe shkrimet indiane.
PDF e rregullon faqen: gërmat, vektori, imazhet raster dhe koordinatat e tekstit janë të ngrira kështu që çdo lexues sheh një strukturë identike. Si ruhet faqja vendos se me çfarë rezolucioni dhe ngjyrash duhet të punojë njohësi.
Po — PDF është një grafik objekti, jo një figurë faqeje, kështu që teksti mbetet i zgjedhshëm dhe vektori mbetet i mprehtë pavarësisht se çfarë ndodh me përmbajtjen raster brenda tij. Kjo ndikon në atë që njohësi mund të shohë.
Në një skanim të pastër 300 DPI të tekstit të shtypur, mjaft i lartë që gabimet janë të rralla dhe kryesisht në emra të pazakontë të vetinjve. Saktësia bie mprehtë me rezolucion të ulët, të shtrembëruar, hije nga kamera e telefonit, tipare të pazakonta dhe shkrim me dorë — shkrimi me dorë në veçanti nuk është për këtë.
300 DPI në gri është pika e mirë. Nën 200 DPI, forma e karaktereve fillon të prishet; mbi 400 DPI, nuk fiton asgjë dhe paguan për këtë në madhësinë e file dhe kohën e përpunimit.
Çdo PDF standard, duke përfshirë ato të prodhuara nga një skaner, një program për përpunimin e tekstit apo një driver printeri. Filet me fjalëkalim pronari që vetëm kufizon modifikimin trajtohen; file që kërkojnë fjalëkalim përdoruesi për t'u hapur nuk trajtohen dhe nuk përpiqemi të thyem kriptimin.
Po: llogaritë e lira përpunojnë dokumente deri në 5 MB secili, që mbulon shumicën e raporteve dhe kontratave por jo një dokument të gjatë të skanuar në 600 DPI; Ghostscript dhe qpdf bëjnë punën. PDF-të e skanuara janë gjëja e zakonshme që e tejkalojnë atë dhe kompresimi i dokumentit së pari është normalisht i mjaftueshëm për ta kthyer atë nën.
Teksti dhe vektorët janë objekte dhe jo piksela, kështu që mbeten të mprehtë në çdo zmadhim, pavarësisht se ç'ndodh. Vetëm figurat raster të përfshira mund të degradohen dhe vetëm nëse operacioni që keni zgjedhur i ri-shembullon ato.
Po — ngarko koleksionin dhe ata do të përpunohen paralelisht nën një koleksion rregullimesh, që është qëllimi i kryrjes së një dokumenti të rrjedhës së punës këtu në vend të klikimit nëpërmjet një lexuesit desktop.
Konturat, lidhjet e brendshme dhe komentet ruhen kurdoherë që operacioni e lejon këtë. Firmat dixhitale janë përjashtimi: çdo ndryshim në file do të anullojë një firmë, sepse kjo është pikërisht ajo për çka është një firmë.
Numri OCR PDF është i lirë pa një llogari dhe asgjë nuk shtypet në faqe. Dokumentet e ngarkuar fshihen nga punëtorët menjëherë pasi të përfundojë detyra.

Vlerësoni këtë mjet

5.0/5 - 0 vota
ns6.com - Pa pagesë WHOIS privatësi, DNS dhe SSL në çdo domene.
Ose lësho skedarët e tu këtu