1Laden Sie den gescannten PDF documents hoch; ein sauberer 300 DPI Graustufen-Scan gibt dem Erkennungsgerät das meiste, mit dem zu arbeiten ist.
2Sag ihm, welche Sprache zu erwarten ist — die Bezeichnung der Sprache schlägt, indem sie sie mit einem breiten Rand raten lässt.
3Führen Sie den Erkennungspass aus; die Wörter werden als unsichtbare Ebene über dem Originalbild zurückgeschrieben.
4Laden Sie die durchsuchbare PDF Datei herunter — sie sieht identisch aus, aber Sie können jetzt den Text darin suchen und auswählen.
OCR PDF Häufig gestellte Fragen
Wonach soll ich das beste Ergebnis suchen?
+
300 DPI in Graustufen ist der süße Fleck. Unter 200 DPI-Zeichenformen beginnen sich zu zerbrechen; über 400 DPI gewinnen Sie fast nichts und zahlen dafür in Dateigröße und Bearbeitungszeit.
Wie wird OCR PDF ein Scan in Text verwandelt?
+
Konkret jede Seite wird gerendert, läuft durch einen Tesseract Text-Erkennung übergeben in über 100 Sprachen, und die erkannten Wörter werden als unsichtbare Textebene über dem Originalbild positioniert zurückgeschrieben — so sieht die Seite unverändert aus, ist aber durchsuchbar und wählbar. Die Seite sieht immer noch genau so aus wie sie es tat — der anerkannte Text sitzt unsichtbar hinter dem Bild, so dass Suche und Auswahl ohne Änderung des Aussehens funktionieren.
Irgendetwas Besonderes an PDF hier?
+
Ja, ein PDF ist ein Objektgraph, kein Seitenbild, also bleibt Text wählbar und Vektoren bleiben scharf, egal was mit dem Rasterinhalt darin geschieht. Es wirkt sich auf das aus, was der Erkenner sehen kann.
Wie genau ist es?
+
Auf einem sauberen 300 DPI Scan gedruckten Textes, hoch genug, dass Fehler selten und meist in ungewöhnlichen richtigen Substantiven sind. Genauigkeit fällt mit geringer Auflösung, Skew, Schatten von einer Telefonkamera, ungewöhnliche Schriften und Handschriften stark ab — insbesondere Handschrift ist nicht das, wofür dies ist.
Was kann ich auf OCR PDF hochladen?
+
Jedes Standard-PDF, einschließlich eines von einem Scanner, einem Textverarbeitungsgerät oder einem Druckertreiber erstellten. Dateien mit einem Besitzerpasswort, das nur die Bearbeitung beschränkt, werden behandelt; Dateien, die ein Benutzerpasswort zum Öffnen benötigen, sind nicht, und wir versuchen nicht, die Verschlüsselung zu brechen.
Gibt es eine Dateigröße auf OCR PDF?
+
Ja: Kostenlose Konten bearbeiten Dokumente bis 5 MB, die die meisten Berichte und Verträge abdecken, aber kein lange gescanntes Dokument bei 600 DPI; Ghostscript und qpdf erledigen die Arbeit. Gescannte PDFs sind das Übliche, was sie übersteigt, und das Komprimieren des Dokuments reicht normalerweise aus, um es wieder unterzubringen.
Wird OCR PDF die Qualität meiner PDF documents senken?
+
Text und Vektorgrafik sind Objekte statt Pixel, so dass sie bei jedem Zoom perfekt scharf bleiben, egal was passiert. Nur die eingebetteten Rasterbilder können abwerten, und nur wenn die Operation sie neu ausprobiert.
Kann ich OCR PDF auf mehreren PDF documents gleichzeitig laufen?
+
Ja — Laden Sie den Satz hoch und sie verarbeiten parallel unter einer Reihe von Einstellungen, was der Punkt ist, einen Dokumenten-Workflow hier zu tun, anstatt über einen Desktop-Reader zu klicken.
Warum ist ein EPUB Site Host OCR PDF?
+
EPUB.to ist rund um das offene eBook-Format gebaut — XHTML in einem Reißverschluss, reflowable durch Design, und lesbar auf Hardware niemand hat über das Layout für gedacht. Ein Buch ist ein Zip voller Markup, Bilder und Schriftarten, so dass fast jeder Job, den Leute auf eine eBook-Website bringen, wirklich ein Job auf einem dieser Dinge ist. OCR PDF läuft auf dem gleichen Upload und dem gleichen Konto wie die Konvertierungen, weil das ist, wo es benötigt wird.
Was soll ich mit dem Ergebnis machen, wenn OCR PDF fertig ist?
+
Der Konverter auf dieser Seite bewegt Bücher zwischen EPUB, MOBI, AZW3, PDF und DOCX, so dass ein Titel auf welcher Hardware es tatsächlich lesen wird. Das bedeutet, dass nach OCR PDF die Umwandlung aus der Version, auf der Sie sich niedergelassen haben, gemacht wird, nicht von der, die Sie noch repariert haben.
Ist OCR PDF hier das gleiche Werkzeug, das die Geschwisterseiten laufen?
+
Die Motoren werden geteilt — die gleiche Werkzeugkette, die gleichen Arbeiter, die gleichen Grenzen. Was eine EPUB-Site hinzufügt, ist eine Ansicht über den Reflow: welche dieser Operationen ein reflowables Buch wirklich unterstützt, und welche nur Sinn machen auf den feststehenden Medien darin. Es beginnt auch mit einer Tatsache über das Format, nach dem diese Seite benannt ist: das Buch ist ein ZIP von XHTML mit einem Manifest, so dass der Text fast nichts kostet und jede Entscheidung, die zählt, ist über die eingebetteten Bilder und Schriftarten-Untergruppen.
Brauche ich ein Konto und wird irgendetwas aufbewahrt?
+
Kein Konto, und nichts wird gehalten: Uploads werden von den Arbeitern kurz nach dem Job gelöscht, nichts wird gelesen und nichts wird indiziert. Kostenlose Konten für Geschichte und Batch-Größe, nicht für den Zugriff.
Laden und konvertieren Sie mehrere Dateien auf einmal mit einem Pro-Plan. Sparen Sie Zeit - keine Notwendigkeit, sie eins nach dem anderen zu verarbeiten.