1Качи сканирания PDF documents; чист 300 DPI сиви скенери дава на препознавателя най-много да работи с.
2Кажи му кой език да очаква — името на езика е по-добро от това да го оставиш да познае с широка граница.
3Изпълнете пропуска за разпознаване; думите се пишат като невидим слой, който седи над оригиналния страницен образ.
4Изтегляне на претърсваем PDF файл — той изглежда идентично, но сега можете да търсите и да изберете текста в него.
ОРС PDF ЧЗВ
Как ОРС PDF превръща сканиране в текст?
+
Конкретно, всяка страница е изработена, пропускате през Тесеракт текст-презрение преминаване на над 100 езика, и признатите думи са писани обратно като невидим текстов слой, разположен над оригиналното изображение — така че страницата изглежда непроменена, но е търслива и селектираща. Страницата все още изглежда точно както направи – признатият текст стои невидимо зад изображението, така че търсене и подбор работа, без да променя външния вид.
Кои езици може да разпознае?
+
Над 100, включително латински, кирилици, гръцки, арабски, иврит, китайски, японски, корейскиндийски скрипти. Разказвайки му кой език да очакват материално повишаване на точността, отколкото да го позная.
Дали форматът на източника влияе на разпознаването?
+
Така е. PDF корекции на страницата: шрифтове, вектори, растрови изображения и текстови координати са замразени, така че всеки четец вижда идентично оформление. Как се съхранява страницата решава каква информация за разделяне и цветове трябва да работи с него.
Нещо конкретно за PDF тук?
+
Да — PDF е обект графика, а не страница изображение, така че текст остава избираем и вектори остават остри, независимо какво се случва с растровото съдържание вътре в него. Тя засяга това, което може да види.
Колко точно е?
+
На чист 300 DPI сканиране на печатен текст, достатъчно висока, че грешките са редки и най-вече в необичайни правилни именници. Точността пада рязко с ниска резолюция, мърля, сенки от телефонна камера, необичайни букви и почерк – по-специално почеркът не е за това, за което е предназначена.
Какво трябва да сканирам за най-добрия резултат?
+
300 DPI в сиви бои е сладкото място. Под 200 DPI символи форми започват да се разпадат; над 400 DPI печелите почти нищо и плащате за него в размер на файла и време на обработка.
Какво мога да кача на ОРС PDF?
+
Всякакъв стандартен PDF, включително и тези, произведени от скенер, от текстов процесор или от драйвер за печат. Обработват се файлове с парола на собственик, която само ограничава редактирането; файлове, които се нуждаят от парола за отваряне на потребителя, не са и не се опитваме да разбием шифроването.
Има ли ограничение на размера на файла на ОРС PDF?
+
Да: безплатни сметки обработват документи до 5 MB всеки, който обхваща повечето доклади и договори, но не и дълго сканиран документ на 600 DPI; Ghostscript и qpdf извършват работата. Сканирани PDF са обичайното нещо, което надвишава, и първото компресиране на документа е достатъчно, за да го върнете под.
Will ОРС PDF lower the quality of my PDF documents?
+
Текст и вектор изкуството са обекти, а не пиксели, така че те остават перфектно остър при всяко увеличение независимо какво се случва. Само вградените растрови изображения могат да деградират, и само ако операцията, която избрахте да ги преизберете.
Мога ли да направя ОРС PDF на няколко PDF documents наведнъж?
+
Да — качване на комплекта и те се обработват паралелно под един набор от настройки, което е точката на извършване на документ работен поток тук, вместо да кликнете през четене на настолни компютри.
Оцелява ли оцеляването на запазващите се книги, връзките и полетата за формуляр?
+
Оригиналните черти, вътрешните връзки и анотации се съхраняват там, където й позволява операцията. Дигиталните подписи са изключението: всяка промяна в файла задължително анулира подпис, защото точно за това е подпис.
Does ОРС PDF cost anything?
+
Не. ОРС PDF е безплатно без сметка, и нищо не е печатено на страниците. Качени документи се изтриват от работниците скоро след като работата завърши.