Vapaa suunnitelma: 1 muunnos/tunti, 1 tiedosto kerrallaan
Go Unlimited →

OCR-PDF

Vapaa online PDF OCR

Valitse tiedostosi

*Tiedostot poistetaan 24 tunnin kuluttua

Muunna jopa 1 Gt:n tiedostoja ilmaiseksi, Pro-käyttäjät voivat muuntaa jopa 100 Gt:n tiedostoja; Rekisteröidy nyt

Lähetetään

0%

Miten OCR- lääkitys tehdään PDF

1 Lataa skannattu PDF documents; puhtaan 300 DPI-harmaaskaalaskannauksen avulla tunnistaja voi työskennellä eniten.
2 Kerro, mitä kieltä voit odottaa: kielen nimeäminen voittaa sen arvaamisen suurella erolla.
3 Suorita tunnustuskortti; sanat kirjoitetaan takaisin alkuperäisen sivun kuvan päälle istuvana näkymättömänä kerroksena.
4 Lataa hakukelpoinen PDF tiedosto – se näyttää samalta, mutta voit nyt etsiä ja valita sen tekstin.

OCR-PDF Usein kysytyt kysymykset

Miten OCR PDF muuttaa skannauksen tekstiksi?
+
Käytännössä Jokainen sivu käännetään, käydään läpi Tesseractin tekstitunnistuskortti yli sadalla kielellä, ja tunnetut sanat kirjoitetaan takaisin alkuperäisen kuvan päälle sijoitettuna näkymättömänä tekstikerroksena – joten sivu näyttää muuttumattomalta, mutta on hakukelpoinen ja valittavissa. Sivu näyttää edelleen aivan samalta kuin se teki – tunnustettu teksti istuu kuvan takana näkymättömänä, joten etsi ja valitse työ ilman, että ulkonäkö muuttuu.
Yli sata, mukaan lukien latina, kyrilli, kreikka, arabia, heprea, kiina, japani, korea ja indic-kirjoitukset. Kertomalla, mitä kieltä odottaa, parannetaan aineellisesti tarkkuutta sen sijaan, että antaisit sen arvailla.
Se tekee. PDF korjaa sivun: fontit, vektorit, rasterikuvat ja tekstikoordinaatit ovat jäässä, joten jokainen lukija näkee samanlaisen asettelun. Miten sivu tallennetaan, päättää, minkä resoluution ja väritietojen kanssa tunnistajalla on tehtävä töitä.
Kyllä – PDF on objektigraafi, ei sivukuva, joten teksti pysyy valittavissa ja vektorit pysyvät terävinä riippumatta siitä, mitä sen sisällä olevalle rasterisisällölle tapahtuu. Se vaikuttaa siihen, mitä tunnistaja näkee.
Puhtaassa 300 DPI-kuvauksessa painetun tekstin kohdalla on tarpeeksi korkea virheiden määrä, joka on harvinainen ja useimmiten epätavallinen asiallinen substantiivi. Tarkkuus putoaa terävästi matalan resoluution, vinon, puhelimen kameran varjojen, epätavallisten tyyppien ja käsialan avulla – erityisesti käsiala ei ole sitä, mitä varten se on.
Harmaasävyinen 300 DPI on makea paikka. Alle 200 DPI-hahmon hahmoa alkaa hajota, yli 400 DPI:n kohdalla ei saada juuri mitään ja siitä maksetaan tiedostokokoa ja käsittelyaikaa.
Kaikki vakiomuotoiset PDF-tiedostot, mukaan lukien skannerin, sanaprosessorin tai tulostusajurin tuottamat. Tiedostot, joissa on omistajan salasana, joka vain rajoittaa muokkausta, käsitellään; tiedostot, jotka tarvitsevat käyttäjän salasanan avataksemme, eivät ole, emmekä yritä murtaa salausta.
Kyllä: Ilmaistilit käsittelevät asiakirjoja aina 5 MB asti, mikä kattaa useimmat raportit ja sopimukset, mutta ei pitkää skannattua asiakirjaa 600 DPI:ssä; Ghostscript ja qpdf tekevät työn. Skannatut PDF-muodossa olevat ovat tavallista suurempi asia, ja asiakirjan pakkaaminen ensin riittää yleensä palauttamaan sen alle.
Teksti- ja vektoritaide ovat kohteita pikseleiden sijaan, joten ne pysyvät täysin terävinä missä tahansa zoomissa, tapahtui mitä tahansa. Vain sulautetut rasterikuvat voivat hajota, ja vain jos valitsemasi toiminto ottaa niistä uudelleen näytteen.
Kyllä – lataa setti ja ne prosessoidaan rinnakkain yhden asetuskokonaisuuden alla, mikä on tarkoitus tehdä dokumenttityön virtaus täällä sen sijaan, että klikkaisi työpöytälukijan kautta.
Esiviivat, sisäiset linkit ja merkinnät säilytetään aina, kun se on toiminnan mahdollista. Digitaaliset allekirjoitukset ovat poikkeus: kaikki muutokset tiedostoon mitätöivät allekirjoituksen, koska se on juuri sitä varten.
Ei. OCR PDF on ilmainen ilman tiliä, eikä mitään leimata sivuille. Ladatut asiakirjat poistetaan työntekijöiltä pian työn päätyttyä.

Arvostele tämä muokkain

5.0/5 - 0 ääntä
ns6.com - 800+ verkkotunnuslaajennuksia. Etsi täydellinen nimesi.
Tai pudota tiedostosi tähän