Bezpłatny plan: 1 konwersja na godzinę, 1 plik na raz
Idź Nieograniczony →

OCR PDF

Darmowy online PDF OCR

Wybierz swoje pliki

*Pliki usunięte po 24 godzinach

Konwertuj bezpłatnie pliki o rozmiarze do 1 GB. Użytkownicy Pro mogą konwertować pliki o rozmiarze do 100 GB. Zarejestruj się teraz

Przesyłanie

0%

Jak prowadzić OCR PDF

1 Wyślij skanowany PDF documents; czysty skan od szarego kąta 300 DPI daje rozpoznawcy najwięcej do pracy.
2 Powiedz, który język można oczekiwać — nazwa języka to lepsze niż to, by zgadnąć o szerokim stopniu.
3 Uruchom przepustkę rozpoznawania; słowa są zapisane jako niewidzialna warstwa siedząca nad oryginalnym obrazem strony.
4 Pobierz plik wyszukiwalny PDF — wygląda identyczny, ale teraz możesz wyszukać i wybrać tekst w nim.

OCR PDF Często zadawane pytania

Jak OCR PDF przekształca skan w tekst?
+
Konkretnie, Każda strona jest wyświetlana, przebiega przez przepustkę Tesseract tekstu rozpoznawania w ponad 100 językach, a uznane słowa są napisane z powrotem jako niewidzialna warstwa tekstu umieszczona nad oryginalnym obrazem – więc strona wygląda niezmieniona, ale jest wyszukiwana i wybierana. Strona wciąż wygląda dokładnie tak, jak to zrobiła – rozpoznany tekst siedzi niewidzialnie za obrazem, więc wyszukiwanie i selekcja pracy bez zmiany wyglądu.
Ponad 100, w tym latyno, cyrylika, grecki, arabski, hebrajski, chiński, japoński, koreańskindycki skrypt. Mówiąc, który język, aby oczekiwać materialnie poprawia dokładność nad dając jej zgadnąć.
Tak jest. PDF poprawia stronę: czcionki, wektory, rastrowe obrazy i współrzędne tekstu są zamrożone, tak aby każdy czytelnik widział identyczny układ. Jak przechowywana jest strona decyduje, z jakiej rozdzielczością i kolorem musi pracować rozpoznawca.
Tak – a PDF to wykres obiektu, a nie obraz strony, więc tekst pozostaje wybrany i wektory pozostają ostre, bez względu na to, co się stanie z zawartością rasteru wewnątrz. To wpływa na to, co widzi rozpoznawca.
Na czystym skanowaniu 300 DPI drukowanego tekstu, wystarczająco wysokim, że błędy są rzadkie i głównie w niezwykłych właściwych jęcześciach. Dokładność odpada ostrie z niską rozdzielczością, ścierpieniem, cieniami z kamery telefonicznej, niezwykłymi liczbami i pisaniem — nie jest to w szczególności to, do czego służy pisanie.
300 DPI w cenie szarości jest słodkim miejscem. Poniżej 200 DPI kształtów znaków zaczynają się rozkładać; powyżej 400 DPI nie osiągasz prawie nic i nie płacisz za to w rozmiarze pliku i czasie przetwarzania.
Każdy standardowy PDF, w tym skanerowy, przetwarzacz słowny lub sterownik druku. Obsługuje się pliki z hasłem właściciela, które ograniczają edycję; pliki, które potrzebują hasła użytkownika do otwarcia nie są, i nie próbujemy złamać szyfrowania.
Tak: bezpłatne konta przetwarzają dokumenty do 5 MB każde, które obejmują większość raportów i kontraktów, ale nie długi dokument skanowany w 600 DPI; Ghostscript i qpdf wykonywają pracę. Skanowane PDF są zwykłą rzeczą, która przewyższa go, a ścisnięcie dokumentu najpierw jest zwykle wystarczające, aby go ponownie podnieść.
Tekst i wektorowe grafiki to obiekty, a nie piksele, więc pozostają one doskonale ostre w każdym powiększeniu, nieważne co się stanie. Tylko wbudowane obrazy rasterowe mogą zniższyć, i tylko jeśli operacja, którą wybrałeś, ich przeprodukuje.
Tak — wysyłanie zestawu i przetwarzanie równoległe pod jednym zestawem ustawień, co jest punktem wykonywania dokumentu przepływu pracy tutaj zamiast kliknięcia przez czytacz pulpitu.
Określenia, wewnętrzne linki i anotacje są zachowane wszędzie, gdzie to pozwala na operację. Podpisy cyfrowe są wyjątkiem: każda zmiana pliku musi koniecznie unieważnić podpis, ponieważ właśnie to jest podpis.
Nie. OCR PDF jest bezpłatny bez konta, a na stronach nic nie jest znaczone. Wysłane dokumenty są usuwane od pracowników wkrótce po zakończeniu pracy.

Oceń to narzędzie

5.0/5 - 0 głosów
ns6.com - Twoja domena, zrobione dobrze. Darmowa prywatność i DNS w tym.
Albo upuść swoje pliki tutaj