1Բեռնել սկանավորված PDF documents-ը։ 300 DPI սևի և սպիտակի շերտերի սկանավորումը ճանաչողին տալիս է առավելագույն հնարավորություններ աշխատանքի համար։
2Ընդունելություն անգլերեն լեզվով (անգլ.՝ Acceptance of English as a Foreign Language)՝ անգլերեն լեզվի ընդունելության ընթացակարգը։
3Օգտագործել ճանաչման անցումը։ Բառերը գրվում են որպես անտեսանելի շերտ, որը տեղադրված է սկզբնական էջում։
4Բեռնել որոնման համար նախատեսված PDF ֆայլը. այն նույնն է, բայց դուք կարող եք փնտրել և ընտրել դրա մեջ գտնվող տեքստերը։
OCR PDF Հաճախակի տրվող հարցեր
Ո՞ր վայրում պետք է սկանավորեմ՝ լավագույն արդյունքի հասնելու համար։
+
300 DPI- ն սևի և սպիտակի միջև լավագույն տարբերակն է։ 200 DPI- ից ցածր նկարները սկսում են քայքայվել։ 400 DPI- ից բարձր նկարները ոչ մի օգուտ չեն տալիս, և դրա համար վճարում եք ֆայլի չափով և գործընթացի ժամանակով։
Ինչպե՞ս է OCR PDF-ը սկանը փոխակերպում տեքստի։
+
Հիմնականում, յուրաքանչյուր էջը ցուցադրվում է, անցնում է Tesseract-ի տեքստի ճանաչման գործընթացը 100-ից ավելի լեզուներով, և ճանաչված բառերը գրվում են որպես անտեսանելի տեքստի շերտ, որը տեղադրվում է սկզբնական պատկերի վրա, այսպիսով էջը չի փոխվում, բայց կարող է որոնվել և ընտրվել. էջը դեռևս այնպիսին է, ինչպիսին եղել է՝ ճանաչված տեքստը՝ պատկերի հետևում, այնպես որ որոնումը և ընտրությունը կատարվում են առանց տեսքը փոխելու։
Ո՞րևէ բան, որ հատուկ է PDF-ին:
+
Այո - PDF-ը օբյեկտային գրաֆիկ է, ոչ թե էջերի պատկեր, այնպես որ տեքստը մնում է ընտրելի և վեկտորները մնում են հստակ՝ անկախ նրանից, թե ինչ է պատահում ներսում գտնվող ռեզերային բովանդակությանը. Դա ազդում է այն բանի վրա, թե ինչ կարող է տեսնել ճանաչողը:
Ինչքանո՞վ է ճշգրիտ այն։
+
Տպված տեքստի 300 DPI- ի մաքուր սկանավորման դեպքում, այնքան բարձր, որ սխալները հազվադեպ են և հիմնականում անսովոր սեփական անունների դեպքում։ Պարզությունը զգալիորեն նվազում է ցածր ճանաչողականության, սխալների, հեռախոսի տեսախցիկի տակ եղած մոխրագույնի, անսովոր տառատեսակների և ձեռքի գրության դեպքում, հատկապես ձեռքի գրության դեպքում այս գործիքը չի աշխատում։
Ի՞նչ կարող եմ տեղադրել OCR PDF-ում։
+
Բոլոր ստանդարտ PDF-ները, ներառյալ սկաների, տեքստային գործընկերների կամ տպագրման դյուրակիրների կողմից ստեղծվածները։ Փաստաթղթերը, որոնց տիրոջ գաղտնաբառը սահմանափակում է միայն խմբագրումը, կիրառվում են։ Փաստաթղթերը, որոնց բացելու համար անհրաժեշտ է տիրոջ գաղտնաբառը, չեն կիրառվում, և մենք չենք փորձում խախտել գաղտնագրումը։
Արդյո՞ք OCR PDF-ում ցուցադրվում է ֆայլի չափի սահմանափակում
+
Այո: ազատ հաշիվները կարող են յուրաքանչյուրը մինչև 5 MB փաստաթղթերի ընթացք տալ, ինչը ներառում է զեկույցների և պայմանագրերի մեծամասնությունը, բայց ոչ երկար 600 DPI-ով սկանավորված փաստաթղթերը։ Ghostscript-ն ու qpdf-ը կատարում են աշխատանքը. Սկանավորված PDF-ները սովորաբար գերազանցում են այս ցուցակը, և փաստաթղթի նախնական ճնշումը սովորաբար բավարար է այն վերադարձնելու համար:
Արդյոք OCR PDF-ը կնվազեցնի իմ PDF documents-ի որակը։
+
Ձեռագրերը և վեկտորային նկարները օբյեկտներ են, ոչ թե կետեր, այնպես որ դրանք մնում են ամբողջությամբ ճշգրիտ ցանկացած մեծացման դեպքում, անկախ նրանից, թե ինչ է կատարվում։ Միայն ներկառուցված ռաստերային պատկերները կարող են նվազել, և միայն եթե ձեր ընտրած գործողությունը վերամշակում է դրանք։
Կարո՞ղ եմ միաժամանակ մի քանի PDF documents համակարգիչների վրա ընթացիկ պահել OCR PDF-ը։
+
Այո, բարձրացրեք հավաքածուն և այն կկատարվի զուգահեռորեն, միևնույն ռեժիմով, ինչը փաստաթղթի աշխատանքային հոսքի նպատակն է, այլ ոչ թե աշխատասեղանի կարդացողի միջոցով սեղմելու նպատակը։
Ինչո՞ւ է EPUB կայքը ապահովում OCR PDF?
+
EPUB.to-ը կառուցված է բաց eBook ֆորմատի շուրջ - XHTML zip-ում, reflowable է դիզայնով, և կարդացվում է hardware-ում, որի համար ոչ ոք չի մտածել դասավորության մասին. Գիրքը zip ֆայլ է, որը լցված է նշաններով, պատկերներով և տառատեսակներով, այնպես որ գրեթե յուրաքանչյուր աշխատանք, որը մարդիկ eBook կայք են բերում, իրականում այդպիսի աշխատանք է։ OCR PDF-ը աշխատում է նույն տեղադրման և նույն հաշվին, ինչ վերածումը, քանի որ այնտեղ է, որտեղ այն անհրաժեշտ է։
Ի՞նչ պետք է անեմ արդյունքի հետ, երբ OCR PDF-ը ավարտվել է։
+
Այս կայքի փոխակերպիչը գրքերը EPUB, MOBI, AZW3, PDF և DOCX ձևաչափերի միջև է փոխադրում, այնպես որ գիրքերը կստանան այնպիսի տեսք, որը կկարողանան կարդալ ցանկացած սարքավորումները։ OCR PDF-ից հետո դա անելը նշանակում է, որ փոխակերպումը կատարվել է այն տարբերակից, որի վրա դուք համաձայնել եք, ոչ թե այն տարբերակից, որը դեռևս փակում էիք։
Արդյո՞ք OCR PDF-ում նույն գործիքն է, ինչ որ սերնդակից կայքերում։
+
Դիժեներները նույնական են, նույն գործիքային խումբը, նույն աշխատողները, նույն սահմանափակումները։ EPUB կայքը ավելացնում է վերահղման տեսանկյուն՝ որն է այդ գործողությունների մեջ այն, որ վերահղման գիրքն իրականում աջակցում է, և որոնք են այն գործողությունները, որոնք նշանակալի են միայն դրա մեջ գտնվող նյութի համար։ Այն նաև սկսվում է այն ձևաչափի մասին մի փաստից, որի անունով է այս կայքը կոչվում՝ գրքը XHTML- ի zip- ը է, որը պարունակում է ցուցակ, այսպիսով տեքստը գրեթե ոչինչ չի արժենա, և ամեն կարևոր որոշումը վերաբերում է ներկառուցված պատկերներին և տառատեսակների ենթախմբերին։
Ես հաշիվ ունեմ, և ինչ-որ բան պահվում է։
+
Ոչ մի հաշիվ, և ոչինչ չի պահվում: վերբեռնումները հեռացվում են աշխատողներից աշխատանքի ավարտից անմիջապես հետո, ոչինչ չի կարդացվում և ոչինչ չի ինդեքսավորվում: Ազատ հաշիվներ կան պատմության և խմբի չափի համար, ոչ թե մուտք գործելու համար: