1Feltölti a beszkennelt PDF documents; egy tiszta 300 dpi szürke skála vizsgálat adja a felismerő a legtöbbet dolgozni.
2Mondd meg neki, melyik nyelven várhatja el, hogy a nyelv neve jobb, ha széles sávban találgat.
3Futtasd le a felismerő hágót; a szavakat láthatatlan rétegként írták vissza, amely az eredeti oldal képén ül.
4Töltse le a kereshető PDF fájlt ~ azonosnak tűnik, de most már kereshet és kiválaszthatja a benne lévő szöveget.
OCR PDF GYIK
Mit kell beszkennelni a legjobb eredmény?
+
300 dpi szürkeárnyalatban az édes folt. 200 dpi karakteralak alatt kezd lebontani; 400 dpi felett szinte semmit sem nyersz és fizetsz érte a fájlméretben és a feldolgozásban.
Hogyan alakítja a OCR PDF egy szkenn-t szövegté?
+
Konkrétan, minden oldalt lefordítunk, végigfutunk egy Tesseract szövegfelismerő pass-on több mint 100 nyelven, és az elismert szavakat visszaírjuk láthatatlan szövegrétegként, amely az eredeti képre helyezkedik ~ így az oldal változatlannak tűnik, de kereshető és választható. Az oldal még mindig pontosan úgy néz ki, mint ~ az elismert szöveg láthatatlanul a kép mögött ül, így a keresés és kiválasztás a megjelenés megváltoztatása nélkül működik.
Van valami konkrét PDF-re?
+
Igen, A PDF egy objektum grafikon, nem egy oldalkép, így a szöveg marad kiválasztható és vektorok marad éles nem számít, mi történik a raszter tartalom benne. Ez befolyásolja, amit a felismerő lát.
Mennyire pontos?
+
A tiszta 300 DPI-s letapogatáson a nyomtatott szöveg, elég magas, hogy hibák ritkák és többnyire szokatlan megfelelő főnevek. Pontosság esik le élesen alacsony felbontású, skew, árnyékok egy telefon kamera, szokatlan betűk és kézírás ~ kézírás különösen nem ez az, amire ez.
Mit tölthetek fel a OCR PDF - re?
+
Bármilyen szabványos PDF, beleértve a szkenner által gyártottakat, egy szóprocesszor vagy egy nyomtató meghajtó. A tulajdonos jelszavával rendelkező fájlok, amelyek csak korlátozzák a szerkesztést, nem kerülnek feldolgozásra; olyan fájlok, amelyek megnyitásához felhasználó jelszóra van szükség, és nem próbálunk meg feltörni titkosítást.
Van-e fájlméret-határ a OCR PDF-on?
+
Igen: ingyenes számlafolyamatok dokumentumok 5 MB minden, amely kiterjed a legtöbb jelentések és szerződések, de nem egy hosszú beszkennelt dokumentum 600 DPI; Ghostscript és qpdf csinálni a munkát. A letapogatott PDF-ek a szokásosak, amik meghaladják azt, és a dokumentum első tömörítése általában elég ahhoz, hogy visszahozzuk.
A OCR PDF csökkenti a PDF documents-em minőségét?
+
A szöveg és a vektorok a képpontok helyett tárgyak, így minden zoomnál tökéletesen élesek maradnak, bármi történjék is. Csak a beágyazott raszterképek bomlanak le, és csak akkor, ha a művelet, amit választottál, újramintazi őket.
Lefuttathatom a OCR PDF-t egyszerre több PDF documents-en is?
+
Igen • töltse fel a készletet, és párhuzamosan egy beállítási csomagban is feldolgozzák, ami a dokumentum munkafolyamatának a lényege, ahelyett, hogy egy asztali olvasón keresztül kattintana.
Miért ad otthont a EPUB oldalnak OCR PDF?
+
EPUB.to épül a nyitott eBook formátum • XHTML egy zip, újrafúvható a design, és olvasható hardveren senki nem gondolt az elrendezés. A könyv egy zip tele van jelfeltöltéssel, képekkel és betűtípusokkal, így szinte minden munka, amit az eBook oldalra hoznak, valóban egy munka az egyik ilyen dologban. OCR PDF ugyanazzal a feltöltéssel és a számlával fut, mint az átalakítások, mert ott van szükség rá.
Mit tegyek az eredménnyel, ha a OCR PDF véget ért?
+
Az átalakító ezen az oldalon mozgatja a könyveket EPUB, MOBI, AZW3, PDF és DOCX, így a cím végül, hogy bármilyen hardver is fogja olvasni. Ha ezt csinálod OCR PDF után, az azt jelenti, hogy a megtérést abból a változatból csinálod, amin megegyeztél, nem abból, amin még mindig javítgattál.
A OCR PDF ugyanaz az eszköz, amit a testvérek is használnak?
+
A motorok közös szerszámlánc, ugyanazok a dolgozók, ugyanazok a határértékek. Amit egy EPUB oldal hozzáad egy nézet az újraáramlás: melyik ilyen műveletek egy újraáramlás könyv valóban támogatja, és amelyek csak van értelme a fix-layout média belül. Ez is kezdődik egy tény a formátumot ez az oldal nevét követően: A könyv egy zip of XHTML egy manifeszt, így a szöveg szinte semmibe kerül, és minden döntés, ami számít, a beágyazott képek és betűtípusok alosztályai.
Kell-e egy számla, és megtartanak bármit is?
+
Nincs számla, és semmi sem marad: a feltöltést röviddel a munka befejezése után töröljük a dolgozóktól, semmit sem olvasunk és semmit sem indexelünk. A történelem és a tételméret tekintetében ingyenes számlák léteznek, nem pedig hozzáférés.