3. samm: laadige alla oma konverteeritud fail DOCX failid
JPG kuni DOCX Konversiooni KKK
Kas teisendamine JPG DOCX- ks annab mulle redigeeritava teksti?
+
Jah, kui OCR on lubatud ~ pildi analüüsimine, märgid on tunnustatud ja kirjutatud DOCX kui reaalne tekst saab valida, otsida ja muuta. OCR välja, JPG lihtsalt pannakse dokumendis pildina. JPG on JPEG standard 1992. aastast ja pärast kolme aastakümmet on see ikka formaat kõige kaameraid ja enamik veebisaite kasutada fotosid. DOX on Office Open XML, formaat Word on vaikimisi toodetud alates 2007. aastast ja ISO standardit alates 2008. aastast.
Kui täpne on teksti äratundmine?
+
Trükitud teksti puhtal, sirgel ja suure resolutsiooniga skaneerimisel on täpsus tavaliselt üle 98%. See langeb maha madala lahutusvõime, viltu, varjude, värviliste või tekstuuriga taustadega, ebatavaliste fontide ja eriti käekirjaga ® käsikirju tuleks käsitleda ebausaldusväärsena.
Kuidas ma saan parima OCR tulemuse oma JPG?
+
Skaneeri või pildista 300 DPI või parem, hoia leht sirge ja ruudu kaamera, süüdata see ühtlaselt, ja vältida raske kompressiooni. Sest JPG salvestab 8-bitise RGB läbi kaduva DCT, mille vaikimisi on 4:2:0 kroma subsampling, nii et peen punane tekst ja kõvad servad on esimesed pehmendavad asjad, allikas salvestatud madala kvaliteediga on kompressiooni esemeid ümber iga täht, ja äratundja loeb neid osana Glyph.
Milliseid keeli saab tunnustada?
+
Kõik peamised ladina-script keeled pluss kirillitsa, kreeka, araabia, heebrea, hiina, jaapani ja korea keel. Ütle konverterile, millist keelt oodata ~ äratundja kasutab keelemudelit, ja õige mõõdab mitmetähenduslikult täpsust mitmetähenduslike tähtede osas.
Kas lehekülje kujundus on säilinud?
+
Lugemine järjekord, lõikepausid ja lihtsad veerud on taastatud. Keerulised ajakirja paigutused, külgribad, joonealused märkused ja teksti mähitud pilte lineariseeritakse ~ sõnad on kõik seal, kuid visuaalne paigutus on lihtsustatud.
Kas tabelid on tabelis?
+
Reegeldatud tabelid nähtavate alusjoontega rekonstrueeritakse tavaliselt tegelike DOCX tabelitena. Tables configured only with tühimärkidega loetakse sageli lihtteksti veergudena, sest paigutusanalüsaatoril ei ole visuaalseid piire, mida avastada.
Kas ma võin mitu lehekülge JPG teisendada üheks dokumendiks?
+
Jah ~ laadi leheküljed järjekorras üles ja neist saavad ühe DOCX järjestikused leheküljed või osad. Nimeta failid, et nad sorteeriksid need õigesti, sest failinimede järjekord määrab lehekülje järjekorda.
Mis siis, kui ma tahan ainult pilti dokumendisse, mitte teksti?
+
OMT väljalülitamine. Seejärel põimitakse JPG pildina, mille suurus on leheküljeni, ja DOCX sisaldab pildi asemel märke. See on õige valik fotode, diagrammide ja kunstiteose jaoks.
Kas pildi kvaliteet langeb DOCX sisse?
+
Põimitud pilt lisatakse algsesse eraldusvõimesse ja seda saab kasutada ainult ekraanil. Kuna DOX on kinnine OOXML kimp ~ tekst on XML, nii et see jääb redigeeritav, otsitav ja diffable, võib dokument pärast DOX on kinnine OOXML kimp ~ tekst on XML, nii et see jääb redigeeritav, otsitav ja diffable salvestamist uuesti kokku suruda, sõltuvalt rakenduse seadistustest, mistõttu võib väga suur foto pärast ringreisi veidi pehmem välja näha.
Kas ma võin tulemust hiljem muuta?
+
Jah ® väljund on normaalne DOCX, mis avaneb igas ühilduvas redaktoris. See on üldiselt põhjus, miks teisendatakse: lehte saab muuta lamedaks pildiks, mida saab parandada, ümber korraldada ja taaskasutada.
Kas ma peaks OCR väljundit lugema?
+
Alati, midagi, mis loeb. Tunnustamise vead klastri numbrit, kirjavahemärgid ja õige nimisõnad ~ täpselt sisu, kus viga teeb kõige rohkem kahju. Kohtle OCR väga kiire esimene eelnõu, mitte valmis ärakirja.
Kas mu JPG privaatsus on teisendamise ajal?
+
Jah ~ üleslaadimised töödeldakse isoleeritud töötajatega ja kustutatakse minutite jooksul. Skaneeritud dokumente, mis sisaldavad sageli isikuandmeid, ei salvestata, vaadatakse üle ega kasutata koolituseks. Vaata / privaatsus /.