1Скан қилинган PDF documents ни юклаб олиш; тоза 300 DPI оқ рангли скан танловчига кўпроқ ишлаш имконини беради.
2Унга қайси тил кутилишини айтинг - тил номига қўйиш унга ажабланишни кенг имконият билан амалга оширишга имкон беради.
3Танитиш жараёнини амалга ошириш; сўзлар асл саҳифа тасвири устида кўринмас қатлам сифатида қайта ёзилади.
4PDF файлни юклаб олинг - у бир хил кўринади, аммо энди унда матнни қидириш ва танлашингиз мумкин.
PDF TSS
PDF қандай қилиб сканни матнга айлантиради?
+
Маълумот учун, Ҳар бир саҳифа 100 дан ортиқ тилда Tesseract матн-таниб олиш йўли орқали репродукция қилинади ва танилган сўзлар асл тасвир устида жойлаштирилган кўринмас матн қатламида қайта ёзилади - шунинг учун саҳифа ўзгармаган кўринади, аммо қидириш ва танлаш мумкин. Саҳифа ҳали ҳам худди аввалгидек кўринади - танилган матн тасвир ортида кўринмайди, шунинг учун қидириш ва танлаш кўриниш ўзгармасдан ишлайди.
Қайси тилларни таниб олади?
+
100 дан ортиқ, жумладан, латин, кирилл, юнон, араб, иврит, хитой, япон, корейс ва ҳинд ёзувлари. Унга қайси тил кутилишини айтиши, унга ажабланишни қўйишдан кўра аниқликни яхшилайди.
Манба формати тан олишга таъсир кўрсатадими?
+
У шундай. PDF саҳифани тузатади: ҳарфлар, векторлар, растер тасвирлар ва матн координаталари ҳар бир ўқитувчи бир хил кўринишдаги кўринишларни кўриши учун музлатилади. Саҳифанинг қандай сақланаётганини аниқлаш учун, танитувчи қандай резолюция ва ранг маълумотлари билан ишлаш кераклигини белгилайди.
PDF учун бирор нарса борми?
+
Ҳа — PDF саҳифа тасвири эмас, объект графикаси, шунинг учун матн танлаб олиниши мумкин ва векторлар унинг ичида нима бўлаётганидан қатъи назар аниқ қолади. Бу таниб олувчи нимани кўриши мумкинлигига таъсир қилади.
У қанчалик аниқ?
+
Матннинг 300 DPI даги тоза сканировкаси, хатолар кам учраши ва кўпинча ноодатий ўз исмлар билан боғлиқ бўлиши учун етарли даражада юқори. Низоми паст, қиррали, телефон камераси соялари, ноодатий шрифтлар ва қўл ёзуви билан аниқлик кескин тушади - қўл ёзуви бунинг учун мўлжалланмаган.
Энг яхши натижа учун нимани текшириш керак?
+
300 DPI оқ рангда энг яхши жой. 200 DPI дан пастда белги шакллари бузилиши бошланади; 400 DPI дан юқорида сиз ҳеч нарсага эриша олмайсиз ва бунинг учун файл ҳажми ва ишлаш вақтида тўлашингиз керак бўлади.
PDFга нимани юклаб олишим мумкин?
+
Сканер, сўз ишловчи ёки принтер драйвери томонидан яратилган барча стандарт PDF файллар. Файл эгасининг махфий сўзи билан фақат таҳрирлашни чеклайдиган файллар ишлатилади; файлларни очиш учун фойдаланувчининг махфий сўзи керак бўлган файллар ишлатилмайди ва биз шифрлашни бузишга уринмаймиз.
PDF учун файл ҳажми чегараси борми?
+
Ҳа: free accounts ҳар бири 5 MB гача ҳужжатни ишлайди, бу кўпроқ ҳисобот ва шартномаларни қамраб олади, аммо 600 DPI даги узун скан қилинган ҳужжатни қамраб олмайди; Ghostscript ва qpdf буни бажаради. Скан қилинган PDFлар буни оширадиган оддий нарсалардир ва ҳужжатни аввал сиқиш уни яна бу остида олиб келиш учун етарли бўлади.
PDF менинг PDF documents сифатини пасайтирадими?
+
Матн ва вектор графикаси пикселлар эмас, балки объектлардир, шунинг учун улар ҳар қандай катталаштиришда ҳам аниқ кўринади. Фақатгина ёпилган растер тасвирлари заифлашади ва фақатгина сиз танлаган операция уларни қайта намуналашни талаб қилсагина.
PDF ни бир вақтда бир нечта PDF documents да ишга тушира оламанми?
+
Ҳа — тўпламни юклаб олиш ва улар бир тўпламдаги параметрлар остида параллел равишда ишлаш, бу иш столи ўқигичи орқали босиш ўрнига ҳужжат иш оқимини бажаришнинг мақсади.
Китоб белгилари, ҳаволалар ва шакл майдонлари сақланиб қоладими?
+
Контурлар, ички алоқалар ва аннотациялар операция рухсат берган жойларда сақланиб қолади. Рақамли имзолар бундан мустасно: файлдаги ҳар қандай ўзгариш имзони бекор қилади, чунки имзо шунинг учун керак.
PDF қиймати нима?
+
PDF рақами ҳисобсиз эркин ва саҳифаларга ҳеч нарса босилмайди. Юклаб олинган ҳужжатлар иш тугагандан сўнг тезда ишловчилардан ўчириб ташланади.