Freier Plan: 1 Konvertierung/Stunde, 1 Datei auf einmal
Unlimitiert gehen →

OCR PDF

Lesen Sie die Worte im Inneren PDF documents

Setzen Sie sich auf Ihre Dateien

*Dateien werden nach 24 Stunden gelöscht

Dateien frei konvertieren, Pro-Benutzer können viel größere Dateien konvertieren; Jetzt anmelden

Hochladen

0%

Wie ist OCR PDF zu verwenden?

1 Laden Sie den gescannten PDF documents hoch; ein sauberer 300 DPI Graustufen-Scan gibt dem Erkennungsgerät das meiste, mit dem zu arbeiten ist.
2 Sag ihm, welche Sprache zu erwarten ist — die Bezeichnung der Sprache schlägt, indem sie sie mit einem breiten Rand raten lässt.
3 Führen Sie den Erkennungspass aus; die Wörter werden als unsichtbare Ebene über dem Originalbild zurückgeschrieben.
4 Laden Sie die durchsuchbare PDF Datei herunter — sie sieht identisch aus, aber Sie können jetzt den Text darin suchen und auswählen.

OCR PDF Häufig gestellte Fragen

Wonach soll ich das beste Ergebnis suchen?
+
300 DPI in Graustufen ist der süße Fleck. Unter 200 DPI-Zeichenformen beginnen sich zu zerbrechen; über 400 DPI gewinnen Sie fast nichts und zahlen dafür in Dateigröße und Bearbeitungszeit.
Konkret jede Seite wird gerendert, läuft durch einen Tesseract Text-Erkennung übergeben in über 100 Sprachen, und die erkannten Wörter werden als unsichtbare Textebene über dem Originalbild positioniert zurückgeschrieben — so sieht die Seite unverändert aus, ist aber durchsuchbar und wählbar. Die Seite sieht immer noch genau so aus wie sie es tat — der anerkannte Text sitzt unsichtbar hinter dem Bild, so dass Suche und Auswahl ohne Änderung des Aussehens funktionieren.
Ja, ein PDF ist ein Objektgraph, kein Seitenbild, also bleibt Text wählbar und Vektoren bleiben scharf, egal was mit dem Rasterinhalt darin geschieht. Es wirkt sich auf das aus, was der Erkenner sehen kann.
Auf einem sauberen 300 DPI Scan gedruckten Textes, hoch genug, dass Fehler selten und meist in ungewöhnlichen richtigen Substantiven sind. Genauigkeit fällt mit geringer Auflösung, Skew, Schatten von einer Telefonkamera, ungewöhnliche Schriften und Handschriften stark ab — insbesondere Handschrift ist nicht das, wofür dies ist.
Jedes Standard-PDF, einschließlich eines von einem Scanner, einem Textverarbeitungsgerät oder einem Druckertreiber erstellten. Dateien mit einem Besitzerpasswort, das nur die Bearbeitung beschränkt, werden behandelt; Dateien, die ein Benutzerpasswort zum Öffnen benötigen, sind nicht, und wir versuchen nicht, die Verschlüsselung zu brechen.
Ja: Kostenlose Konten bearbeiten Dokumente bis 5 MB, die die meisten Berichte und Verträge abdecken, aber kein lange gescanntes Dokument bei 600 DPI; Ghostscript und qpdf erledigen die Arbeit. Gescannte PDFs sind das Übliche, was sie übersteigt, und das Komprimieren des Dokuments reicht normalerweise aus, um es wieder unterzubringen.
Text und Vektorgrafik sind Objekte statt Pixel, so dass sie bei jedem Zoom perfekt scharf bleiben, egal was passiert. Nur die eingebetteten Rasterbilder können abwerten, und nur wenn die Operation sie neu ausprobiert.
Ja — Laden Sie den Satz hoch und sie verarbeiten parallel unter einer Reihe von Einstellungen, was der Punkt ist, einen Dokumenten-Workflow hier zu tun, anstatt über einen Desktop-Reader zu klicken.
EPUB.to ist rund um das offene eBook-Format gebaut — XHTML in einem Reißverschluss, reflowable durch Design, und lesbar auf Hardware niemand hat über das Layout für gedacht. Ein Buch ist ein Zip voller Markup, Bilder und Schriftarten, so dass fast jeder Job, den Leute auf eine eBook-Website bringen, wirklich ein Job auf einem dieser Dinge ist. OCR PDF läuft auf dem gleichen Upload und dem gleichen Konto wie die Konvertierungen, weil das ist, wo es benötigt wird.
Der Konverter auf dieser Seite bewegt Bücher zwischen EPUB, MOBI, AZW3, PDF und DOCX, so dass ein Titel auf welcher Hardware es tatsächlich lesen wird. Das bedeutet, dass nach OCR PDF die Umwandlung aus der Version, auf der Sie sich niedergelassen haben, gemacht wird, nicht von der, die Sie noch repariert haben.
Die Motoren werden geteilt — die gleiche Werkzeugkette, die gleichen Arbeiter, die gleichen Grenzen. Was eine EPUB-Site hinzufügt, ist eine Ansicht über den Reflow: welche dieser Operationen ein reflowables Buch wirklich unterstützt, und welche nur Sinn machen auf den feststehenden Medien darin. Es beginnt auch mit einer Tatsache über das Format, nach dem diese Seite benannt ist: das Buch ist ein ZIP von XHTML mit einem Manifest, so dass der Text fast nichts kostet und jede Entscheidung, die zählt, ist über die eingebetteten Bilder und Schriftarten-Untergruppen.
Kein Konto, und nichts wird gehalten: Uploads werden von den Arbeitern kurz nach dem Job gelöscht, nichts wird gelesen und nichts wird indiziert. Kostenlose Konten für Geschichte und Batch-Größe, nicht für den Zugriff.

Bewerten Sie dieses Tool

5.0/5 - 0 Stimmen
ns6.com — Freie WHOIS Privatsphäre, DNS und SSL auf jeder Domain.
Oder laden Sie Ihre Dateien hier hoch.