1Ngaupload gambar anu dipikaca PDF documents; gambar skala abu-abu 300 DPI anu bersih bakal ngamungkinkeun pangidentipikasi pikeun damel.
2Basa anu digunakeun dina acara-acara ieu nyaéta basa Sunda, anu dipaké ku masarakat Sunda.
3Ngajalankeun pamahaman; kecap-kecap ditulis deui salaku lapisan anu teu katingali anu disimpen di luhur gambar halaman asli.
4Unduh berkas PDF anu bisa dicari - éta katingalina sami, tapi ayeuna anjeun tiasa milarian sareng milih teks dina éta.
PDF OCR FAQ
Kepiye cara OCR PDF ngowahi scan dadi teks?
+
Konkretna, saben kaca digambar, dileksanakake liwat Tesseract teks-ngakoni pasa ing luwih saka 100 basa, lan tembung-tembung kang diakui ditulis maneh minangka lapisan teks kang ora katon diunggah ing gambar asli — supaya kaca katon ora diubah nanging bisa dicari lan dipilih. Halaman masih katingali sakumaha anu dipikahoyong - teks anu dipikawanoh aya di tukang gambar anu teu katingali, jadi pencarian jeung pilihan bisa dilaksanakeun tanpa ngarobah tampilan.
Basa apa sing bisa diidentifikasi?
+
Diantarana Latin, Cyrillic, Greek, Arabic, Hebrew, Chinese, Japanese, Korean sarta Indian scripts. Nyatakeunana basa mana anu kudu diharepkeun ngaronjatkeun akurasi dibandingkeun ngabéjaanana pikeun ngaduga.
Apa format sumber mengaruhi pengenalan?
+
Éta leres. PDF ngresiki kaca: fonta, vektor, gambar raster lan koordinat teks ditetepake supaya saben pembaca bisa ndeleng tata letak sing padha. Kumaha halaman disimpen nangtukeun résolusi na informasi warna naon anu kudu digawékeun ku pangaweruh.
Apa ana sing spesifik kanggo PDF ing kene?
+
Ya — PDF iku grafik objek, ora gambar kaca, mula teks tetep bisa dipilih lan vektor tetep cetha, apa wae sing kedadeyan karo isi raster ing njero. Ieu mangaruhan naon anu bisa ditempo ku panyebut.
Apa sing bener?
+
Dina scan 300 DPI tina teks anu dicetak, cukup luhur pikeun ngaleungitkeun kasalahan, utamana dina kecap-kecap anu teu biasa. Akurasi turun drastis nalika resolusi handap, leungit, bayangan ti kamera telepon, font anu teu biasa, jeung tulisan tangan — tulisan tangan hususna henteu dipikabutuh.
Apa sing kudu aku scan kanggo asil sing paling apik?
+
300 DPI dina skala bodas nyaéta titik anu saé. Di handapeun 200 DPI, bentuk karakter mimiti rusak; di luhur 400 DPI, anjeun henteu kéngingkeun nanaon sareng mayar pikeun éta dina ukuran file sareng waktos pamrosésan.
Apa sing bisa dakmuat menyang OCR PDF?
+
PDF standar naon waé, kaasup anu dihasilkeun ku pamilari, pemroses kecap atawa driver cetak. Berkas anu kecap akses pamakéna ngan ukur ngawatesan panyetelanana diurus; berkas anu butuh kecap akses pangguna pikeun dibuka henteu diurus, sarta urang henteu coba ngarusak enkripsi.
Apa ana wates ukuran file ing OCR PDF?
+
Ya: akun gratis proses dokumen nganti 5 MB saben, sing nglindhungi akeh laporan lan kontrak nanging ora dokumen sing discan dawa ing 600 DPI; Ghostscript lan qpdf nindakake kerja. PDF anu diimbau biasana biasa anu ngaleuwihan ukuranana, sarta ngaleupaskeun dokumen mimitina biasana cukup pikeun ngareset deui.
Apa OCR PDF bakal nyuda kualitas saka PDF documentsku?
+
Teks jeung karya seni vektor nyaéta objék lain piksel, jadi aranjeunna tetep sampurna tajam dina zoom naon waé, naon waé kajadian. Ngan gambar raster anu dilebetkeun tiasa diturunkeun, sareng ngan upami operasi anu anjeun pilih ngarekam deui aranjeunna.
Apa aku bisa ngaktifake OCR PDF ing pirang-pirang PDF documents kanthi bebarengan?
+
Ya — ngaunduh set sarta aranjeunna ngaproses paralel dina hiji set setting, anu tujuanna pikeun ngalakukeun aliran kerja dokumen di dieu tibatan klik ngaliwatan pembaca desktop.
Apa tanda buku, tautan lan lapangan formulir tetep ana?
+
Garis-garis, tautan jero, sarta anotasi dilestarikan dimana wae operasi ngamungkinkeun éta. Tandatangan digital mangrupa pengecualian: sagala parubahan kana berkas pasti ngaleungitkeun tandatangan, sabab éta anu pasti anu dipikabutuh ku tandatangan.
OCR PDF regane apa?
+
No. OCR PDF bébas tanpa akun, sarta teu aya anu ditempelkeun kana halaman. Dokumen anu diunggah dihapus ti worker sanggeus tugas réngsé.