Piano libero: 1 conversione/ora, 1 file alla volta
Vai illimitato →

OCR PDF

Leggi le parole dentro PDF documents

Seleziona i tuoi file

*File eliminati dopo 24 ore

Convertire i file gratis, gli utenti Pro possono convertire file molto più grandi; Iscriviti ora

Caricamento in corso

0%

Come OCR PDF

1 Caricare il PDF documents scannerizzato; una scansione in scala di grigi pulita 300 DPI dà al riconoscimento il massimo con cui lavorare.
2 Digli quale lingua aspettarsi che nomini il linguaggio batte lasciandolo indovinare per un ampio margine.
3 Eseguire il riconoscimento pass; le parole sono scritte indietro come un livello invisibile seduto sopra l'immagine della pagina originale.
4 Scarica il file ricercabile PDF {} {} } sembra identico, ma ora è possibile cercare e selezionare il testo in esso.

OCR PDF Domande frequenti

A cosa devo fare la scansione per ottenere il miglior risultato?
+
300 DPI in scala di grigi è il punto dolce. Sotto 200 forme di caratteri DPI iniziano a rompersi; sopra 400 DPI si guadagna quasi nulla e pagare per esso in dimensioni del file e tempo di elaborazione.
Concretamente, ogni pagina è resa, esegui un passaggio di riconoscimento testi Tesseract in oltre 100 lingue, e le parole riconosciute sono scritte indietro come un livello di testo invisibile posizionato sopra l'immagine originale ® così la pagina appare invariata ma è ricercabile e selezionabile. La pagina appare ancora esattamente come ha fatto Hoppenstedt il testo riconosciuto si trova invisibilmente dietro l'immagine in modo da cercare e selezionare lavorare senza cambiare l'aspetto.
Si', un PDF è un grafico di oggetti, non un'immagine di pagina, quindi il testo rimane selezionabile e i vettori rimangono nitide non importa cosa accade al contenuto raster all'interno di esso. Colpisce cio' che il riconosciutore puo' vedere.
Su una scansione pulita 300 DPI di testo stampato, abbastanza alto che gli errori sono rari e soprattutto in nomi insoliti. Accuratezza cade bruscamente con bassa risoluzione, spiedo, ombre da una telecamera, caratteri insoliti e scrittura Hoppenstedt a mano in particolare non è a questo scopo.
Qualsiasi PDF standard, compresi quelli prodotti da uno scanner, da un processore di testi o da un driver di stampa. I file con una password proprietaria che limita solo l'editing vengono gestiti; i file che necessitano di una password utente per aprirsi non sono, e non tentiamo di rompere la crittografia.
Sì: Gli account gratuiti elaborano documenti fino a 5 MB ciascuno, che copre la maggior parte dei rapporti e contratti ma non un documento scansionato a lungo a 600 DPI; Ghostscript e qpdf fanno il lavoro. I PDF scansionati sono la cosa usuale che lo supera, e comprimere il documento prima è normalmente sufficiente per riportarlo sotto.
Testo e grafica vettoriale sono oggetti piuttosto che pixel, quindi rimangono perfettamente nitide in qualsiasi zoom, non importa cosa accada. Solo le immagini raster incorporate possono degradarsi, e solo se l'operazione scelta le ricampiona.
Sì, caricare il set e procedere in parallelo sotto un insieme di impostazioni, che è il punto di fare un flusso di lavoro di documenti qui piuttosto che fare clic su un lettore desktop.
EPUB.to è costruito intorno al formato aperto eBook Un libro è una zip piena di markup, immagini e font, quindi quasi ogni lavoro che la gente porta su un sito eBook è davvero un lavoro su una di quelle cose. OCR PDF funziona sullo stesso upload e lo stesso account delle conversioni perché è lì che è necessario.
Il convertitore di questo sito muove libri tra EPUB, MOBI, AZW3, PDF e DOCX, quindi un titolo finisce su qualsiasi hardware sta per leggerlo. Fare questo dopo OCR PDF significa che la conversione è fatta dalla versione che hai impostato, non da quella che stavi ancora riparando.
I motori sono condivisi.., la stessa toolchain, gli stessi lavoratori, gli stessi limiti. Ciò che aggiunge un sito EPUB è una vista sul reflow: quale di queste operazioni un libro reflowable supporta veramente, e quali solo hanno senso sui supporti di layout fisso all'interno di esso. Si parte anche da un dato di fatto circa il formato che questo sito ha chiamato dopo: il libro è una zip di XHTML con un manifesto, quindi il testo costa quasi nulla e ogni decisione che conta riguarda le immagini e i sottoinsiemi di font incorporati.
Nessun account e niente è tenuto: gli upload vengono cancellati dai lavoratori poco dopo la fine del lavoro, nulla viene letto e nulla è indicizzato. Gli account gratuiti esistono per la storia e le dimensioni del lotto, non per l'accesso.

Valuta questo strumento

5.0/5 - 0 voti
ns6.com • Acquista il tuo dominio da $2/anno. Online in minuti.
Oppure trascina qui i tuoi file