Plan gratuit: 1 conversion/heure, 1 fichier à la fois
Aller sans limite →

OCR PDF

Lire les mots à l'intérieur PDF documents

Réglez vos fichiers

*Fichiers supprimés après 24 heures

Convertir des fichiers gratuits, les utilisateurs Pro peuvent convertir des fichiers beaucoup plus grands; Inscrivez-vous maintenant

Téléchargement

0%

Comment faire pour OCR PDF

1 Téléchargez le scan PDF documents; un scan à échelle grise de 300 DPI propre donne au reconnu le plus à travailler avec.
2 Dites-lui quelle langue vous pouvez attendre — en donnant le nom de la langue, vous la laissez deviner par une large marge.
3 Exécutez le passe de reconnaissance; les mots sont réécrits comme une couche invisible assise sur l'image de page originale.
4 Télécharger le fichier de recherche PDF — il semble identique, mais vous pouvez maintenant rechercher et sélectionner le texte dans celui-ci.

OCR PDF FAQ

Que dois-je scanner pour obtenir le meilleur résultat?
+
300 DPI en échelle grise est le spot doux. En dessous de 200 DPI formes de caractères commencent à se décomposer; au-dessus de 400 DPI vous gagnez presque rien et payez pour elle dans la taille de fichier et le temps de traitement.
Concrètement, chaque page est rendue, passe par un passage de reconnaissance texte Tesseract dans plus de 100 langues, et les mots reconnus sont réécrits comme une couche de texte invisible positionnée sur l'image originale.. La page ressemble toujours exactement à elle — le texte reconnu se trouve invisiblement derrière l'image ainsi la recherche et la sélection fonctionnent sans changer l'apparence.
Oui — un PDF est un graphique objet, pas une image de page, donc le texte reste sélectionnable et les vecteurs restent pointus, peu importe ce qui arrive au contenu raster à l'intérieur. Cela affecte ce que le reconnu peut voir.
Sur un scan propre 300 DPI de texte imprimé, assez élevé que les erreurs sont rares et principalement dans des noms propres inhabituels. L'exactitude tombe brusquement avec une basse résolution, skew, ombres d'une caméra de téléphone, caractères inhabituels et écriture — l'écriture en particulier n'est pas ce que cela est pour.
Tout PDF standard, y compris ceux produits par un scanner, par un processeur de texte ou par un pilote d'impression. Les fichiers avec un mot de passe propriétaire qui limite uniquement l'édition sont traités; les fichiers qui ont besoin d'un mot de passe utilisateur pour ouvrir ne sont pas, et nous ne essayons pas de briser le chiffrement.
Oui : les comptes libres traitent les documents jusqu'à 5 MB chacun, qui couvre la plupart des rapports et des contrats mais pas un long document scanné à 600 DPI; Ghostscript et qpdf font le travail. Les PDF numérisés sont la chose habituelle qui dépasse le document, et la compression du document d'abord suffit normalement pour le ramener sous.
Les œuvres textuelles et vectoriels sont des objets plutôt que des pixels, donc elles restent parfaitement pointues à tout zoom, peu importe ce qui se passe. Seules les images raster intégrées peuvent se dégrader, et seulement si l'opération que vous avez choisie les résample.
Oui — uploadez le jeu et ils le traitent en parallèle sous un seul jeu de paramètres, ce qui est le point de faire un workflow de document ici plutôt que de cliquer sur un lecteur de bureau.
EPUB.to est construit autour du format ouvert eBook — XHTML dans un zip, reflowable par la conception, et lisible sur le matériel que personne n'a pensé à la mise en page pour. Un livre est un zip rempli de balisage, d'images et de polices, donc presque chaque emploi que les gens apportent sur un site eBook est vraiment un travail sur une de ces choses. OCR PDF fonctionne sur le même téléchargement et le même compte que les conversions parce que c'est là qu'il est nécessaire.
Le convertisseur sur ce site déplace des livres entre EPUB, MOBI, AZW3, PDF et DOCX, donc un titre finit sur n'importe quel matériel va réellement le lire. Faire cela après OCR PDF signifie que la conversion est faite à partir de la version sur laquelle vous vous êtes installé, pas de celle que vous étiez encore fixer.
Les moteurs sont partagés — la même chaîne d'outils, les mêmes travailleurs, les mêmes limites. Ce qu'un site EPUB ajoute est une vue sur le reflow: lequel de ces opérations un livre reflowable supporte vraiment, et qui ceux-ci n'ont de sens que sur les supports fixes à l'intérieur. Il commence également d'un fait sur le format de ce site est nommé d'après: le livre est une zip de XHTML avec un manifeste, donc le texte ne coûte presque rien et chaque décision qui compte est sur les images intégrées et sous-ensembles de police.
Aucun compte, et rien n'est conservé : les téléchargements sont supprimés des travailleurs peu après la fin de l'emploi, rien n'est lu et rien n'est indexé.

Évaluez cet outil

5.0/5 - 0 voix
ns6.com — Achetez votre domaine à partir de $2/an. En ligne en quelques minutes.
Ou déposez vos fichiers ici