OCR PDF skan edilmiş bir sənədi necə mətnə çevirir?
+
Hər səhifə render edilir, 100-dən çox dildə Tesseract mətn tanıtma keçidi ilə işləyir və tanınan sözlər orijinal şəklin üstünə yerləşdirilmiş görünməz mətn təbəqəsi kimi geri yazılmışdır - səhifə dəyişilməz görünür, ancaq axtarış və seçmə mümkündür. Səhifə hələ də əvvəlki kimi görünür - tanınan mətn şəklin arxasında görünməz olaraq yerləşir, axtarış və seçmə görünüşü dəyişmədən işləyir.
Hansı dilləri tanıya bilər?
+
Latin, Kiril, Yunan, Ərəb, Yəhudi, Çin, Yapon, Koreya və Hindistan yazıları daxil olmaqla 100-dən çox yazı növü. Hansı dili gözlədiyini söyləmək onun təxmin etməsi ilə müqayisədə dəqiqliyi əhəmiyyətli dərəcədə artırır.
Mənbə formatı tanıtma prosesinə təsir edirmi?
+
PDF səhifəni düzəldir: hər oxuyucunun eyni quruluş görməsi üçün yazı növləri, vektorlar, raster rəsmlər və mətn koordinatları dondurulur. Səhifənin necə saxlanıldığı tanıyıcının hansı həll və rəng məlumatı ilə işləməli olduğunu müəyyən edir.
PDF-ə aid bir şey varmı?
+
Bəli - PDF səhifə rəsmi deyil, obyekt qrafikasıdır, buna görə də mətn seçilə bilər və vektorlar onun içindəki raster məzmununa nə baş verməsinə baxmayaraq kəskin qalır. Bu tanıyıcının gördüyü şeyi təsir edir.
Bu nə qədər doğrudur?
+
Yazılmış mətnin təmiz 300 DPI skanında, səhvlərin çox az və çoxu qeyri-adi adlarda olması üçün kifayət qədər yüksəkdir. Düzgünlük aşağı həll, əyri, telefon kamerasından kölgə, qeyri-adi yazı növləri və əlyazma ilə kəskin şəkildə aşağı düşür - əlyazma xüsusilə bu üçün nəzərdə tutulmamışdır.
Ən yaxşı nəticə üçün nəyi skan etməliyəm?
+
300 DPI qırmızı-rəngli rəngli nöqtədir. 200 DPI-dən aşağıda xarakter formaları dağılmağa başlayır; 400 DPI-dən yuxarıda heç nə qazanmırsınız və bunun üçün fayl ölçüsü və işləmə vaxtı ödəyirsiniz.
OCR PDF-ə nə yükləyə bilərəm?
+
Skaner, söz prosessoru və ya çap sürücüsü tərəfindən yaradılanlar da daxil olmaqla hər hansı standart PDF. Yalnız redaktə edilə bilən sahib şifrəsi olan fayllar idarə olunur; istifadəçi şifrəsi ilə açılan fayllar idarə edilmir və şifrəni qırmağa cəhd etmirik.
OCR PDF-də fayl ölçüsünün həddi varmı?
+
Bəli: pulsuz hesablar 25 MB-a qədər sənədləri işləyir, bu da çoxlu hesabatları və müqavilələri əhatə edir, lakin uzun 600 DPI-də skan edilmiş sənədləri əhatə etmir; Ghostscript və qpdf bu işi görür. Skan edilmiş PDF-lər bu həddi aşan ən adi şeydir və sənədi sıxmaq əvvəlcə onu geri qaytarmaq üçün kifayətdir.
OCR PDF PDF sənədlərinin keyfiyyətini aşağı salacaqmı?
+
Mətn və vektor rəsmləri piksellər deyil, cismlərdir, buna görə də hər hansı bir yaxınlaşdırma zamanı nə baş versə də, onlar tamamilə kəskin qalır. Yalnız daxili raster rəsmləri aşağı düşə bilər və yalnız seçdiyiniz əməliyyat onları yenidən nümunələşdirərsə.
Birdən çox PDF sənədində OCR PDF-ni işlədə bilərəm?
+
Bəli - toplunu yüklə və onlar paralel olaraq bir quruluş altında işləyərlər, bu da masaüstü oxuyucusu vasitəsilə klikləmək əvəzinə sənəd iş axını üçün bir nöqtədir.
Nişanlar, körpülər və form sahələri qorunurmu?
+
Əməliyyat imkan verdiyi təqdirdə, şəkillər, daxili körpülər və qeydlər qorunur. Raqamlı imzalar istisnadır: faylda hər hansı dəyişiklik imzanı qüvvədən salacaq, çünki imzanın məqsədi də budur.
OCR PDF-nin qiyməti nədir?
+
Xeyr. OCR PDF hesab olmadan pulsuzdur və səhifələrdə heç bir şey möhürlənmir. Yüklənmiş sənədlər iş bitdikdən sonra işçilərdən silinir.