1Caricare il PDF documents scannerizzato; una scansione in scala di grigi pulita 300 DPI dà al riconoscimento il massimo con cui lavorare.
2Digli quale lingua aspettarsi che nomini il linguaggio batte lasciandolo indovinare per un ampio margine.
3Eseguire il riconoscimento pass; le parole sono scritte indietro come un livello invisibile seduto sopra l'immagine della pagina originale.
4Scarica il file ricercabile PDF {} {} } sembra identico, ma ora è possibile cercare e selezionare il testo in esso.
OCR PDF Domande frequenti
Come fa OCR PDF a trasformare una scansione in testo?
+
Concretamente, ogni pagina è resa, esegui un passaggio di riconoscimento testi Tesseract in oltre 100 lingue, e le parole riconosciute sono scritte indietro come un livello di testo invisibile posizionato sopra l'immagine originale ® così la pagina appare invariata ma è ricercabile e selezionabile. La pagina appare ancora esattamente come ha fatto Hoppenstedt il testo riconosciuto si trova invisibilmente dietro l'immagine in modo da cercare e selezionare lavorare senza cambiare l'aspetto.
Quali lingue può riconoscere?
+
Oltre 100, tra cui latino, cirillico, greco, arabo, ebraico, cinese, giapponese, coreano e gli scritti indici. Raccontando quale lingua aspettarsi materialmente migliora la precisione oltre lasciando indovinare.
Il formato sorgente influenza il riconoscimento?
+
PDF corregge la pagina: font, vettori, immagini raster e coordinate di testo sono congelati in modo che ogni lettore vede layout identico. Come viene memorizzata la pagina decide con quali risoluzione e informazioni a colori il riconoscimento deve lavorare.
Qualcosa di specifico per PDF qui?
+
Si', un PDF è un grafico di oggetti, non un'immagine di pagina, quindi il testo rimane selezionabile e i vettori rimangono nitide non importa cosa accade al contenuto raster all'interno di esso. Colpisce cio' che il riconosciutore puo' vedere.
Quanto è preciso?
+
Su una scansione pulita 300 DPI di testo stampato, abbastanza alto che gli errori sono rari e soprattutto in nomi insoliti. Accuratezza cade bruscamente con bassa risoluzione, spiedo, ombre da una telecamera, caratteri insoliti e scrittura Hoppenstedt a mano in particolare non è a questo scopo.
A cosa devo fare la scansione per ottenere il miglior risultato?
+
300 DPI in scala di grigi è il punto dolce. Sotto 200 forme di caratteri DPI iniziano a rompersi; sopra 400 DPI si guadagna quasi nulla e pagare per esso in dimensioni del file e tempo di elaborazione.
Cosa posso caricare su OCR PDF?
+
Qualsiasi PDF standard, compresi quelli prodotti da uno scanner, da un processore di testi o da un driver di stampa. I file con una password proprietaria che limita solo l'editing vengono gestiti; i file che necessitano di una password utente per aprirli non sono, e non tentiamo di rompere la crittografia.
C'è un limite di dimensione del file su OCR PDF?
+
Sì: Gli account gratuiti elaborano documenti fino a 5 MB ciascuno, che copre la maggior parte dei rapporti e contratti ma non un documento scansionato a lungo a 600 DPI; Ghostscript e qpdf fanno il lavoro. I PDF scansionati sono la cosa usuale che lo supera, e comprimere il documento prima è normalmente sufficiente per riportarlo sotto.
OCR PDF abbasserà la qualità del mio PDF documents?
+
Testo e grafica vettoriale sono oggetti piuttosto che pixel, quindi rimangono perfettamente nitide in qualsiasi zoom, non importa cosa accada. Solo le immagini raster incorporate possono degradarsi, e solo se l'operazione scelta le ricampiona.
Posso eseguire OCR PDF su diversi PDF documents contemporaneamente?
+
Sì, caricare il set e procedere in parallelo sotto un insieme di impostazioni, che è il punto di fare un flusso di lavoro di documenti qui piuttosto che fare clic su un lettore desktop.
I segnalibri, i link e i campi di forma sopravvivono?
+
Linee di contorno, link interni e annotazioni sono conservati ovunque l'operazione lo permetta. Le firme digitali sono l'eccezione: qualsiasi modifica al file necessariamente invalida una firma, perché è proprio a questo che serve una firma.
OCR PDF costa qualcosa?
+
No. OCR PDF è gratuito senza un account, e nulla è timbrato sulle pagine. I documenti caricati vengono cancellati dai lavoratori poco dopo il completamento del lavoro.
O attendere... la vostra prossima conversione gratuita si sblocca in 00:00:00
File troppo grande
Questo file è più grande del limite di dimensione Gratis per questo tipo di file. Ottieni un pass per convertirlo, e file molto più grandi, in questo momento.
Convertilo subito con un pass di 24 ore:
🔒 Rinnova settimanale · Annulla in qualsiasi momento · Cassa sicura