Pelan percuma: 1 penukaran/jam, 1 fail pada satu masa
Pergi Tanpa Had →

PDF OCR

OCR atas talian percuma PDF

Pilih fail anda

*Fail dipadam selepas 24 jam

Tukar sehingga 1 GB fail secara percuma, pengguna Pro boleh menukar sehingga 100 GB fail; Daftar sekarang

Memuat naik

0%

Bagaimana untuk OCR PDF

1 Muatkan naik PDF documents yang diimbas; imbasan skala kelabu 300 DPI bersih memberikan pengiktirafan yang paling banyak untuk bekerja.
2 Beritahu bahasa mana yang hendak diharapkan — nama bahasa melebihi biarkan ia meneka dengan margin yang luas.
3 Jalankan laluan pengenalan; perkataan ditulis semula sebagai lapisan tak kelihatan duduk di atas imej halaman asal.
4 Muat turun fail bolehcari PDF — ia kelihatan sama, tetapi anda boleh cari dan pilih teks didalamnya.

PDF OCR Soalan Lazim

Bagaimana OCR PDF menukar imbasan ke teks?
+
Secara khusus, setiap halaman dihasilkan, berjalan melalui laluan pengenalan teks Tesseract dalam lebih 100 bahasa, dan perkataan yang dikenali ditulis semula sebagai lapisan teks tak kelihatan diletakkan di atas imej asal — jadi halaman kelihatan tidak berubah tetapi boleh dicari dan dipilih. Halaman masih kelihatan seperti yang ia lakukan - teks yang dikenali duduk tidak kelihatan di belakang imej jadi carian dan pemilihan bekerja tanpa mengubah penampilan.
Lebih 100, termasuk Latin, Cyrillic, Greek, Arab, Hebrew, Cina, Jepun, Korea dan skrip India. Memaklumkan bahasa mana yang dijangkakan secara material meningkatkan ketepatan berbanding membiarkan ia meneka.
Ianya boleh. PDF memperbaiki halaman: fon, vektor, imej raster dan koordinat teks dibekukan supaya setiap pembaca melihat susunatur yang sama. Cara halaman disimpan menentukan resolusi dan maklumat warna yang perlu diguna oleh pengiktirafan.
Ya — PDF adalah graf objek, bukan imej halaman, jadi teks tetap boleh dipilih dan vektor tetap tajam tidak kira apa yang berlaku kepada kandungan raster di dalamnya. Ia mempengaruhi apa yang pengiktirafan boleh lihat.
Pada imbasan 300 DPI bersih teks cetak, cukup tinggi untuk ralat jarang berlaku dan kebanyakannya dalam nama benda yang tidak biasa. Ketepatan jatuh dengan jelas dengan resolusi rendah, lengkung, bayang dari kamera telefon, font yang tidak biasa dan tulisan tangan — tulisan tangan khususnya bukanlah apa yang ini untuk.
300 DPI dalam skala kelabu adalah titik manis. Di bawah 200 DPI bentuk aksara mula rosak; di atas 400 DPI anda tidak mendapat apa- apa dan membayar untuknya dalam saiz fail dan masa pemprosesan.
Sebarang PDF piawai, termasuk yang dihasilkan oleh pengimbas, pemproses kata atau pemacu cetakan. Fail dengan kata laluan pemilik yang hanya membatasi penyuntingan ditangani; fail yang memerlukan kata laluan pengguna untuk dibuka tidak, dan kami tidak cuba memecah penyulitan.
Ya: akaun bebas proses dokumen sehingga 5 MB setiap satu, yang meliputi kebanyakan laporan dan kontrak tetapi bukan dokumen mengimbas panjang pada 600 DPI; Ghostscript dan qpdf melakukan kerja. PDF yang diimbas adalah perkara biasa yang melebihinya, dan memampatkan dokumen pertama biasanya cukup untuk membawanya kembali ke bawah.
Teks dan karya seni vektor adalah objek bukan piksel, jadi mereka tetap tajam pada sebarang zum tanpa mengira apa yang berlaku. Hanya imej raster terbenam boleh merosot, dan hanya jika operasi yang anda pilih sampel semula mereka.
Ya — muat naik set dan mereka diproses secara serentak di bawah satu set tetapan, yang merupakan titik untuk melakukan aliran kerja dokumen di sini daripada mengklik melalui pembaca desktop.
Garis luar, pautan dalaman dan anotasi disimpan di mana-mana operasi membenarkannya. Tandatangan digital adalah pengecualian: sebarang perubahan kepada fail mesti melumpuhkan tandatangan, kerana itulah yang tandatangan adalah untuk.
No. OCR PDF adalah bebas tanpa akaun, dan tiada apa yang ditempel pada halaman. Dokumen yang dimuat naik dipadam dari pekerja tidak lama selepas tugas selesai.

Nilaikan alat ini

5.0/5 - 0 undi
ns6.com - Beli domain anda dalam beberapa minit. Cari, daftar, lancarkan.
Atau letakkan fail anda di sini