Bezpłatny plan: 1 konwersja na godzinę, 1 plik na raz
Idź Nieograniczony →

OCR PDF

Czytaj słowa wewnątrz PDF documents

Wybierz swoje pliki

*Pliki usunięte po 24 godzinach

Konwertuj bezpłatnie pliki o rozmiarze do 1 GB. Użytkownicy Pro mogą konwertować pliki o rozmiarze do 100 GB. Zarejestruj się teraz

Przesyłanie

0%

Jak prowadzić OCR PDF

1 Wyślij skanowany PDF documents; czysty skan od szarego kąta 300 DPI daje rozpoznawcy najwięcej do pracy.
2 Powiedz, który język można oczekiwać — nazwa języka to lepsze niż to, by zgadnąć o szerokim stopniu.
3 Uruchom przepustkę rozpoznawania; słowa są zapisane jako niewidzialna warstwa siedząca nad oryginalnym obrazem strony.
4 Pobierz plik wyszukiwalny PDF — wygląda identyczny, ale teraz możesz wyszukać i wybrać tekst w nim.

OCR PDF Często zadawane pytania

Co powinienem zrobić, żeby znaleźć najlepszy wynik?
+
300 DPI w cenie szarości jest słodkim miejscem. Poniżej 200 DPI kształtów znaków zaczynają się rozkładać; powyżej 400 DPI nie osiągasz prawie nic i nie płacisz za to w rozmiarze pliku i czasie przetwarzania.
Konkretnie, Każda strona jest wyświetlana, przebiega przez przepustkę Tesseract tekstu rozpoznawania w ponad 100 językach, a uznane słowa są napisane z powrotem jako niewidzialna warstwa tekstu umieszczona nad oryginalnym obrazem – więc strona wygląda niezmieniona, ale jest wyszukiwana i wybierana. Strona wciąż wygląda dokładnie tak, jak to zrobiła – rozpoznany tekst siedzi niewidzialnie za obrazem, więc wyszukiwanie i selekcja pracy bez zmiany wyglądu.
Tak – a PDF to wykres obiektu, a nie obraz strony, więc tekst pozostaje wybrany i wektory pozostają ostre, bez względu na to, co się stanie z zawartością rasteru wewnątrz. To wpływa na to, co widzi rozpoznawca.
Na czystym skanowaniu 300 DPI drukowanego tekstu, wystarczająco wysokim, że błędy są rzadkie i głównie w niezwykłych właściwych jęcześciach. Dokładność spada ostrzeżle z niską rozdzielczością, ścierpieniem, cieniami z kamery telefonicznej, niezwykłymi liczbami i piskopisem — nie jest to w szczególności to, do czego to służy.
Każdy standardowy PDF, w tym ten produkowany przez skaner, przez procesora słownego lub sterownika drukowania. Pliki z hasłem właściciela, który ogranicza edycję są obsługiwane; pliki, które potrzebują hasła użytkownika do otwarcia nie są, i nie próbujemy złamać szyfrowania.
Tak: bezpłatne konta przetwarzają dokumenty do 5 MB każde, które obejmują większość raportów i kontraktów, ale nie długi dokument skanowany w 600 DPI; Ghostscript i qpdf wykonywają pracę. Skanowane PDF są zwykłą rzeczą, która przewyższa go, a ścisnięcie dokumentu najpierw jest zwykle wystarczające, aby go ponownie podnieść.
Tekst i wektorowe grafiki to obiekty zamiast pikseli, więc pozostają one idealnie ostre w każdym powiększeniu, bez względu na to co się stanie. Tylko wbudowane obrazy rasterowe mogą zniższyć, i tylko jeśli operacja, którą wybrałeś, je przeprodukuje.
Tak — wysyłanie zestawu i przetwarzanie równoległe pod jednym zestawem ustawień, co jest punktem wykonywania dokumentu przepływu pracy tutaj zamiast kliknięcia przez czytacz pulpitu.
EPUB.to jest zbudowany wokół otwartego formatu eBook — XHTML w zip, reflowable w drodze projektowania, i czytelny na sprzętu, dla którego nikt nie myślał o układu. Książka jest zip pełna znacznika, obrazów i czcionek, więc niemal każde zadanie ludzi przynosi na eBook jest rzeczywiście zadaniem na jednej z tych rzeczy. OCR PDF działa na tym samym konwersji i konwersji, ponieważ tam jest to potrzebne.
Konwerter na tej stronie przenosi książki między EPUB, MOBI, AZW3, PDF i DOCX, więc tytuł kończy się na cokolwiek sprzętu, który faktycznie będzie czytać. Robiąc to po OCR PDF oznacza, że konwersja jest wykonana z wersji, na której się zajęłaś, a nie z tej, którą jeszcze naprawiasz.
Silniki są udostępniane – ta sama łańcucha narzędziowa, ta sama pracownica, te same granice. Co dodaje strona EPUB widok na przepływ: która z tych operacji reflowable książka naprawdę wspiera, a które mają sens tylko na fiksowanych mediach w nim. Zaczyna się również z jednego faktu o formatie tej strony jest nazwany po: książka jest zip XHTML z manifestem, więc tekst kosztuje prawie nic i każda decyzja, która ma znaczenie jest o wbudowanych obrazach i podgrupach czcionek.
Nie ma konta i nic nie jest przechowywane: przesyłki są usuwane z pracowników wkrótce po zakończeniu pracy, nic nie jest czytane i nic nie jest indeksowane. Istnieją bezpłatne konta dla historii i rozmiarów partii, a nie dla dostępu.

Oceń to narzędzie

5.0/5 - 0 głosów
ns6.com — Wolna prywatność WHOIS, DNS i SSL na każdej domenie.
Albo upuść swoje pliki tutaj