Вольны план: 1 conversion/hour, 1 file at a time
Неабмежаваная →

OCR PDF

Прачытаць словы ў PDF documents

Выберыце свае файлы

*Файлы выдаляюцца праз 24 гадзіны

Канвертаваць файлы да 1 ГБ бясплатна, карыстальнікі Pro могуць канвертаваць файлы да 100 ГБ; Зарэгіструйцеся зараз

Загрузка

0%

Як распазнаваць PDF

1 Загрузіць сканаваную PDF documents; чыстая 300 DPI сканаваная графіка з шэрымі адценнямі дае найбольш магчымасцяў для працы.
2 У ёй гаворыцца, што мова, якую вывучаюць, павінна быць адной з моў, якія выкарыстоўваюцца ў свеце.
3 Выканаць разлік. Слова будзе запісана ў невідавочным пластзе, які будзе размешчаны над арыгінальным малюнкам старонкі.
4 Сцягнуць файл з магчымасцю пошуку PDF - ён выглядае ідэнтычным, але вы можаце шукаць і вылучаць тэкст у ім.

OCR PDF Часта задаваныя пытанні

У якім становішчы мне трэба сканаваць, каб атрымаць найлепшы вынік?
+
300 DPI у шэрых адценняў - гэта ідэальная тэмпература. Пры менш чым 200 DPI сімвалы пачынаюць разбурацца; пры больш чым 400 DPI вы не атрымаеце нічога, а толькі павялічваеце памер файла і час апрацоўкі.
У прыватнасці, кожная старонка рэндруецца, праходзіць праз Tesseract для распазнавання тэксту на больш чым 100 мовах, і выяўленыя словы запісваюцца назад як небачныя тэкставыя пласты, размешчаныя над арыгінальным малюнкам - так што старонка выглядае не змененай, але дазваляе пошук і вылучэнне. Старонка выглядае так жа, як і раней - раскрыты тэкст знаходзіцца небазіравана за малюнкам, таму пошук і вылучэнне працуюць без змены выгляду.
Так - PDF - гэта аб' ектная графіка, а не малюнак старонкі, таму тэкст застаецца вылучаным, а вектары застаюцца рэзкімі, незалежна ад таго, што адбываецца з растравым зместам унутры. Гэта ўплывае на тое, што можа бачыць распілоўшчык.
На чыстай 300 DPI сканаванне друкаванага тэксту, дастаткова высокай, каб памылкі былі рэдкімі і большасць з іх у незвычайных уласных імёнах. Дакладнасць рэзка знізіцца з нізкай раздзяляльнасцю, скажэннем, ценямі з камеры тэлефона, незвычайнымі шрыфтамі і рукапісам - рукапіс у прыватнасці не тое, што гэтая праграма для.
Любы стандартны PDF, уключаючы тыя, што створаны сканерам, тэкставым працэсарам або драйверам друку. Файл з паролем уласніка, які абмяжоўвае толькі рэдагаванне, будзе апрацоўвацца; файлы, якія патрабуюць пароля карыстальніка для адкрыцця, не будуць апрацоўвацца, і мы не будзем спрабаваць разблакаваць шыфраванне.
Так: free accounts process documents up to 5 MB each, which covers most reports and contracts but not a long scanned document at 600 DPI; Ghostscript and qpdf do the work. Сканаваныя PDF- дакументы звычайна перавышаюць гэты памер, і спачатку трэба сцерці дакумент, каб вярнуць яго ў папярэдні памер.
Тэкст і векторныя малюнкі - гэта аб' екты, а не пікселя, таму яны застаюцца рэзкімі пры любым павелічэнні. Толькі ўбудаваныя растравыя малюнкі могуць пагоршыцца, і толькі калі выбраная аперацыя перавыбірае іх.
Так - загрузіць набор і яны будуць апрацоўвацца паралельна пад адным набор налад, што з' яўляецца мэтай працы з дакументам тут, а не націскання праз працоўны стол чытача.
EPUB.to пабудаваны вакол адкрытага фармату eBook — XHTML у zip, рэфлоубельны па дызайне, і чытальны на апаратным забеспячэнні, пра макет якога ніхто не думаў. A book is a zip full of markup, images and fonts, so almost every job people bring to an eBook site is really a job on one of those things. OCR PDF runs on the same upload and the same account as the conversions because that is where it is needed.
Канвэртар на гэтым сайце перамяшчае кнігі паміж EPUB, MOBI, AZW3, PDF і DOCX, так што назва заканчваецца на любым апаратным забеспячэнні, якое будзе чытаць яе. Калі вы зробіце гэта пасля OCR PDF, пераўтварэнне будзе зроблена з версіі, якую вы выбралі, а не з той, якую вы яшчэ выпраўлялі.
Рухавікі супольныя - той жа набор інструментаў, тыя ж работнікі, тыя ж абмежаванні. Што дадае сайт EPUB - гэта выгляд перакладу: якія з гэтых аперацый рэфлёйкавая кніга сапраўды падтрымлівае, і якія маюць сэнс толькі на носьбітах з фіксаваным раскладам у ёй. Ён таксама пачынаецца з аднаго факту пра фармат, у гонар якога названы гэты сайт: кніга - гэта файл XHTML з маніфестам, таму тэкст каштуе амаль нічога, і кожнае рашэнне, якое мае значэнне, тычыцца ўбудаваных малюнкаў і падмностваў шрыфтоў.
Няма рахунку, і нічога не захоўваецца: загружаныя файлы выдаляюцца з worker- аў пасля заканчэння заданняў, нічога не чытаецца і не індэксуецца. Вольныя рахункі існуюць для гісторыі і памеру партыі, а не для доступу.

Ацаніце гэты інструмент

5.0/5 - 0 галасоў
С. 6-7 - Ваш дамен, зроблены правільна. Бясплатная прыватнасць і DNS уключаны.
Або перакіньце сюды свае файлы