1Upload den scannede PDF documents; en ren 300 DPI gråskala scanning giver genkenderen mest at arbejde med.
2Fortæl det hvilket sprog der skal forventes! navngivning sproget slår lade det gætte med en bred margen.
3Kør anerkendelse pass; ordene er skrevet tilbage som et usynligt lag sidder over den oprindelige side billede.
4Hent den søgbare PDF fil ~ det ser identisk, men du kan nu søge og vælge teksten i det.
OCR PDF Ofte stillede spørgsmål
Hvad skal jeg scanne efter det bedste resultat?
+
300 DPI i gråskala er det søde sted. Nedenfor 200 DPI tegn figurer begynder at nedbrydes; over 400 DPI får du næsten intet og betaler for det i filstørrelse og behandlingstid.
Hvordan forvandler OCR PDF en scanning til tekst?
+
Konkret, Hver side gengives, køres gennem en Tesseract tekst-anerkendelse pass på over 100 sprog, og de anerkendte ord er skrevet tilbage som en usynlig tekst lag placeret over det oprindelige billede! så siden ser uændret, men er søgbar og valgbar. Siden ser stadig ud præcis som det gjorde! den anerkendte tekst sidder usynligt bag billedet, så søgning og udvælgelse arbejde uden at ændre udseendet.
Noget specifikt for PDF her?
+
Ja ~ en PDF er en objektgraf, ikke et sidebillede, så tekst forbliver valgbar og vektorer forbliver skarpe uanset hvad der sker med rasterindholdet i det. Det påvirker, hvad genkenderen kan se.
Hvor nøjagtigt er det?
+
På en ren 300 DPI scanning af trykt tekst, høj nok til, at fejl er sjældne og for det meste i usædvanlige rigtige navneord. Nøjagtighed falder ud kraftigt med lav opløsning, skæve, skygger fra et telefonkamera, usædvanlige skrifttyper og håndskrift! håndskrift i særdeleshed er ikke, hvad dette er for.
Hvad kan jeg uploade til OCR PDF?
+
Enhver standard PDF, herunder dem, der produceres af en scanner, af en tekstbehandlingsprogram eller af en udskriftsdriver. Filer med en ejer adgangskode, der kun begrænser redigering håndteres; filer, der har brug for en bruger adgangskode til at åbne er ikke, og vi forsøger ikke at bryde kryptering.
Er der en filstørrelsesgrænse på OCR PDF?
+
Ja: gratis konti behandler dokumenter op til 5 MB hver, som dækker de fleste rapporter og kontrakter, men ikke en lang scannet dokument på 600 DPI; Ghostscript og qpdf gøre arbejdet. Scannede PDF-filer er det sædvanlige, der overstiger det, og komprimere dokumentet først er normalt nok til at bringe det tilbage under.
Vil OCR PDF sænke kvaliteten af min PDF documents?
+
Tekst og vektor- kunst er objekter snarere end pixels, så de forbliver perfekt skarpe ved enhver zoom uanset hvad der sker. Kun de indlejrede rasterbilleder kan nedbrydes, og kun hvis den operation du valgte omprøver dem.
Kan jeg køre OCR PDF på flere PDF documents på én gang?
+
Ja ! uploade sættet og de behandler parallelt under et sæt af indstillinger, hvilket er det punkt, at gøre et dokument workflow her i stedet for at klikke gennem en desktop læser.
Hvorfor er et EPUB site vært OCR PDF?
+
EPUB.to er bygget op omkring det åbne e-bog format ~ XHTML i en zip, reflowable af design, og læsbar på hardware ingen har tænkt på layoutet til. En bog er en zip fuld af opmærkninger, billeder og skrifttyper, så næsten alle job folk bringe til en eBook site er virkelig et job på en af disse ting. OCR PDF kører på samme upload og den samme konto som konverteringer, fordi det er der, det er nødvendigt.
Hvad skal jeg gøre med resultatet, når OCR PDF er færdig?
+
Konverteren på dette websted flytter bøger mellem EPUB, MOBI, AZW3, PDF og DOCX, så en titel ender på uanset hardware faktisk kommer til at læse det. Gøre, at efter OCR PDF betyder konverteringen er lavet fra den version, du afregnes på, ikke fra den, du stadig var fastsættelse.
Er OCR PDF her det samme værktøj søskende sites køre?
+
Motorerne deles ~ den samme værktøjskæde, de samme arbejdere, de samme grænser. Hvad en EPUB websted tilføjer er en visning af reflow: hvilken af disse operationer en reflowable bog virkelig understøtter, og hvilke dem kun giver mening på fast-layout medier inde i det. Det starter også fra en kendsgerning om det format, dette websted er opkaldt efter: bogen er en zip af XHTML med en manifest, så teksten koster næsten ingenting og hver beslutning, der betyder noget, er om de indlejrede billeder og skrifttype delmængder.
Skal jeg bruge en konto, og bliver noget gemt?
+
Ingen konto, og intet holdes: uploads slettes fra arbejderne kort efter jobbet slutter, intet læses og intet er indekseret. Gratis konti findes for historie og batch størrelse, ikke for adgang.