1Last opp skannet PDF documents. En ren 300 DPI gråtoneskanning gir gjenkjenneren mest virkemed.
2Fortell det hvilket språk som skal forventes – å gi språket navn slår å gi det et gjetting med stor margin.
3Kjør gjenkjenningspasset, ordene blir skrevet tilbake som et usynlig lag som sitter over det opprinnelige sidebildet.
4Last ned den søkbare fila PDF – den ser identisk ut, men du kan nå søke og velge teksten i den.
OCR PDF Vanlige spørsmål
Hva skal jeg skanne på for det beste resultatet?
+
300 DPI i gråskala er søtpunktet. Under 200 DPI tegn begynner å bryte ned, over 400 DPI får du nesten ingenting og betaler for det i filstørrelse og behandlingstid.
Hvordan gjør OCR PDF en skanning til tekst?
+
Konkret, hver side blir tegnet, kjørt gjennom en tekstgjenkjenning i Tesseract på over 100 språk, og de gjenkjente ordene skrives tilbake som et usynlig tekstlag plassert over originalbildet – så siden ser uendret ut, men kan søkes og velges.. Siden ser fremdeles akkurat slik ut, den gjenkjente teksten sitter usynlig bak bildet, så søk og utvalg virker uten å endre utseende.
Noe spesielt for PDF her?
+
Ja, en PDF er en objektgraf, ikke et sidebilde, så teksten forblir valgbar og vektorer er skarp uansett hva som skjer med raster- innholdet inne i den Det påvirker det som gjenkjenneren kan se.
Hvor nøyaktig er det?
+
På en ren 300 DPI tekstskanning, høy nok til at feil er sjeldne og for det meste i uvanlig riktige substantiv. Nøyaktighet faller kraftig av med lav oppløsning, skjevhet, skygger fra et telefonkamera, uvanlige skrifter og håndskrift – håndskrift spesielt ikke hva dette er til.
Hva kan jeg laste opp til OCR PDF?
+
Alle vanlige PDF- er, også de som en skanner, en tekstbehandler eller en skriverdriver lager. Filer med et eierpassord som bare begrenser redigeringen, håndteres, filer som trenger et brukerpassord for å åpne er ikke det, og vi forsøker ikke å bryte krypteringen.
Er det en filstørrelsesgrense på OCR PDF?
+
Ja: « free accounts » behandler dokumenter opptil 5 MB hver, som dekker de fleste rapporter og kontrakter, men ikke et lenge skannet dokument ved 600 DPI, Ghostscript og qpdf utfører arbeidet. Skannede PDF- er er det vanlige som overstiger det, og å komprimere dokumentet først er normalt nok til å bringe det tilbake under.
Vil OCR PDF senke kvaliteten til min PDF documents?
+
Tekst - og vektorgrafikk er objekter i stedet for piksler, så de holder seg helt skarpe uansett zoom, uansett hva som skjer. Bare de innebygde rasterbildene kan bryte sammen, og bare hvis operasjonen du valgte om- samplinger.
Kan jeg kjøre OCR PDF på flere PDF documents samtidig?
+
Ja, last opp settet og de behandler det parallelt under ett sett med innstillinger, noe som er poenget med å gjøre en arbeidsflyt for dokumentet her i stedet for å klikke gjennom en skrivebordsleser.
Hvorfor en vert EPUB OCR PDF?
+
EPUB.to er bygget rundt det åpne e-bok- formatet – XHTML i en zip, som kan flytes tilbake på en design, og som ingen har tenkt på utformingen av på maskinvare. En bok er en zip full av oppmerking, bilder og skrifttyper, så nesten alle jobber som folk bringer til en e- bok er virkelig en jobb på en av de tingene. OCR PDF kjører på samme opplasting og samme konto som konverteringene fordi det er der den trengs.
Hva skal jeg gjøre med resultatet når OCR PDF er ferdig?
+
Konverteren på dette nettstedet flytter bøker mellom EPUB, MOBI, AZW3, PDF og DOCX, så en tittel ender opp på det maskinvaren egentlig skal lese den. Å gjøre det etter OCR PDF betyr konverteringen er gjort fra den versjonen du ga deg til, ikke fra den du fremdeles fikset.
Er OCR PDF her det samme verktøyet som søsken har?
+
Motorene deles – samme verktøykjede, de samme arbeiderne, de samme grensene. Hva et EPUB - nettsted legger til er en visning på tilbakeflyt: hvilken av disse operasjonene en bok som kan flytes tilbake virkelig støtter, og hvilke som bare gir mening på de faste utleggsmediene i den. Det starter også med en sak om formatet som dette nettstedet heter etter: boken er en zip av XHTML med et manifest, så teksten koster nesten ingenting og hver avgjørelse som spiller inn handler om de innebygde bildene og skriftene..
Trenger jeg en konto, og blir noe holdt?
+
Ingen konto, og ingenting blir beholdt: opplastinger slettes fra arbeiderne kort tid etter at jobben er ferdig, ingenting leses og ingenting indekseres. Det finnes frie kontoer for historie og satsstørrelse, ikke for tilgang.