1Upload dipindai PDF documents; scan skala abu-abu bersih 300 DPI memberikan pengakuan paling banyak untuk dikerjakan.
2Katakan bahasa mana yang diharapkan dari penamaan bahasa mengalahkan membiarkannya dengan margin lebar.
3Jalankan kartu pengakuan; kata-kata ditulis kembali sebagai lapis tak terlihat duduk di atas gambar halaman asli.
4Unduh berkas PDF yang dapat dicari ▪ Ini tampak sama, tetapi Anda dapat mencari dan memilih teks di dalamnya.
PDF OCR Pertanyaan yang Sering Diajukan (FAQ)
Bagaimana OCR PDF mengubah pemindaian menjadi teks?
+
Secara singkat, setiap halaman dirender, jalankan melalui teks Tesseract-enkover dalam lebih dari 100 bahasa, dan kata-kata yang dikenali ditulis kembali sebagai teks tak terlihat diposisikan atas gambar asli å sehingga halaman terlihat tidak berubah tapi dapat dicari dan dipilih. Halamannya masih terlihat persis seperti teks yang dikenali yang duduk tanpa terlihat di balik gambar sehingga pencarian dan pilihan tidak mengubah penampilannya.
Bahasa apa yang bisa dia kenal?
+
Lebih dari 100, termasuk bahasa Latin, Cyrillic, Yunani, Arab, Ibrani, Cina, Jepang, Korea dan Indic.
Apakah format sumber mempengaruhi pengakuan?
+
Hal ini. PDF memperbaiki halaman: font, vektor, gambar raster dan koordinat teks dibekukan sehingga setiap pembaca melihat tata letak yang sama. bagaimana halaman disimpan memutuskan apa resolusi dan informasi warna yang diakui harus bekerja dengan.
Ada yang spesifik pada PDF di sini?
+
Ya, PDF adalah sebuah grafik objek, bukan gambar halaman, jadi teks tetap dapat dipilih dan vektor tetap tajam tidak peduli apa yang terjadi pada isi raster di dalamnya, mempengaruhi apa yang dapat dilihat oleh pengidentifikasi.
Seberapa akurat itu?
+
Pada pemindaian bersih 300 DPI teks tercetak, cukup tinggi bahwa kesalahan jarang dan sebagian besar dalam kata benda yang tidak biasa.
Apa yang harus saya pindai untuk hasil terbaik?
+
300 DPI dalam skala abu-abu adalah tempat yang manis. Di bawah 200 bentuk karakter DPI mulai rusak; di atas 400 DPI Anda tidak mendapatkan apa-apa dan membayar untuk itu dalam ukuran file dan waktu pengolahan.
Apa yang bisa kuunggah ke OCR PDF?
+
PDF standar apapun, termasuk yang diproduksi oleh pemindai, oleh pengolah kata atau pengprint. Berkas dengan kata sandi pemilik yang hanya membatasi penyuntingan ditangani; berkas yang memerlukan sandi pengguna untuk dibuka tidak, dan kami tidak mencoba untuk memecahkan enkripsi.
Apakah ada batas ukuran file pada OCR PDF?
+
Ya: proses akun Gratis proses dokumen hingga 5 MB masing-masing, yang mencakup sebagian besar laporan dan kontrak tetapi bukan dokumen panjang dipindai pada 600 DPI; Ghostscript dan qpdf melakukan pekerjaan. Dipindai PDFs adalah hal biasa yang melebihi itu, dan memampatkan dokumen pertama biasanya cukup untuk membawanya kembali ke bawah.
Akan menurunkan kualitas OCR PDF documents saya?
+
Gambar teks dan vektor adalah objek daripada piksel, sehingga mereka tetap sempurna pada setiap zoom apapun yang terjadi. Hanya gambar raster tertanam dapat menurun, dan hanya jika operasi Anda memilih kembali mereka.
Dapatkah saya menjalankan OCR PDF pada beberapa PDF documents sekaligus?
+
Ya, å upload set dan mereka memproses secara paralel di bawah satu set pengaturan, yang merupakan titik untuk melakukan aliran kerja dokumen di sini daripada mengklik melalui pembaca desktop.
Apakah penanda taut, taut, dan ruas formulir bertahan?
+
Garis luar, link internal dan anotasi diawetkan di mana saja operasi mengijinkannya. Tanda tangan digital adalah pengecualian: setiap perubahan ke berkas selalu tidak berlaku sebagai tanda tangan, karena itulah tepatnya arti tanda tangan.
Apakah OCR PDF biaya apa-apa?
+
No OCR PDF Gratis tanpa akun, dan tidak ada yang dicap ke halaman. Mengunggah dokumen dihapus dari para pekerja segera setelah pekerjaan selesai.