طرح آزاد: ۱ تبدیل در ساعت، ۱ پروندۀ در یک زمان
بدون محدودیت →

OCR PDF

کلمات داخل PDF documents را بخوانید

فایل‌های خود را انتخاب کنید

*فایل‌ها پس از ۲۴ ساعت حذف شدند

تبدیل فایل‌ها رایگان است، کاربران حرفه‌ای می‌توانند فایل‌های بزرگتر را تبدیل کنند؛ الان ثبت نام کن

آپلود

0%

چگونگی OCR PDF

1 Upload the scanned PDF documents; a clean 300 DPI grayscale scan gives the recogniser the most to work with.
2 به آن بگویید که چه زبانی را انتظار داشته باشد - نامگذاری زبان از اجازه دادن به حدس زدن با یک فاصلهٔ وسیع بهتر است.
3 این تابع به صورت زیر عمل می‌کند: تابع تابعی است که در آن یک تابع به صورت یک تابع تصادفی در یک صفحهٔ متنی نوشته می‌شود.
4 پروندۀ PDF قابل جستجو را بارگیری کنید — به نظر مشابه می‌آید، اما حالا می‌توانید متن در آن را جستجو و انتخاب کنید.

OCR PDF سوالات متداول

براي بهترين نتيجه بايد چي رو اسکن کنم؟
+
۳۰۰ dpi در مقیاس خاکستری نقطهٔ شیرین است. زیر ۲۰۰ dpi ، شکل‌های کاراکتر شروع به خراب شدن می‌کنند؛ بالای ۴۰۰ dpi ، تقریباً هیچ چیز بدست نمی‌آورید و برای آن در اندازه پرونده و زمان پردازش هزینه می‌پردازید.
Concretely, هر صفحه نمایش داده می‌شود، از طریق یک گذرگاه تشخیص متن Tesseract در بیش از ۱۰۰ زبان اجرا می‌شود، و کلمات شناسایی شده به عنوان لایه متن نامرئی بر روی تصویر اصلی نوشته می‌شوند — بنابراین صفحه تغییری نکرده به نظر می‌رسد اما قابل جستجو و انتخاب است. The page still looks exactly as it did — the recognised text sits invisibly behind the image so search and selection work without changing the appearance.
بله — یک PDF یک نمودار شیء است ، نه یک تصویر صفحه ، بنابراین متن قابل انتخاب باقی می‌ماند و برداری‌ها بدون توجه به آنچه که برای محتوای راستر درون آن اتفاق می‌افتد ، تیز باقی می‌مانند. این بر آنچه که شناساگر می‌تواند ببیند تأثیر می‌گذارد.
در یک اسکن ۳۰۰ DPI تمیز از متن چاپ شده، به اندازه کافی بالا که خطاها نادر و بیشتر در نام‌های خاص غیرمعمول هستند. دقت با وضوح پایین، انحراف، سایه‌های دوربین تلفن، فونت‌های غیرمعمول و دست‌نوشته‌ها به شدت کاهش می‌یابد — دست‌نوشته‌ها به ویژه چیزی نیست که این برای آن است.
هر پی‌دی‌اف استاندارد ، از جمله آنهایی که توسط یک اسکنر ، یک پردازشگر متن یا یک راننده چاپ تولید شده‌اند. پرونده‌های با گذرواژه مالک که فقط ویرایش را محدود می‌کند ، مدیریت می‌شوند. پرونده‌هایی که برای باز کردن نیاز به گذرواژه کاربر دارند ، مدیریت نمی‌شوند ، و ما تلاش نمی‌کنیم رمزگشایی را بشکنیم.
بله: حسابهای آزاد سندها را تا 5 MB تک پردازش می‌کنند ، که بیشتر گزارشها و قراردادها را پوشش می‌دهد ، اما نه یک سند اسکن‌شده طولانی با ۶۰۰ DPI؛ Ghostscript و qpdf کار را انجام می‌دهند. اسکن شده PDFها چیز معمول است که از آن تجاوز می‌کند، و فشرده سازی سند اول معمولاً کافی است تا آن را به زیر بیاورند.
متن و گرافیک برداری شیء هستند نه پیکسل ، بنابراین در هر بزرگنمایی بدون توجه به اتفاقی که می‌افتد کاملاً تیز باقی می‌مانند. فقط تصاویر راستر توکار می‌توانند تخریب شوند ، و فقط اگر عملیاتی که انتخاب کردید آنها را دوباره نمونه‌گیری کند.
در این روش، یک تابع به صورت یک تابع تصادفی و یک تابع به صورت یک تابع تصادفی در نظر گرفته می‌شود و در نتیجه، یک تابع تصادفی به جای یک تابع تصادفی در نظر گرفته می‌شود.
EPUB.to در اطراف فرمت کتاب الکترونیکی باز ساخته شده است - XHTML در یک zip، reflowable توسط طراحی، و قابل خواندن بر روی سخت‌افزار کسی به طراحی برای آن فکر نکرده است. A book is a zip full of markup, images and fonts, so almost every job people bring to an eBook site is really a job on one of those things. OCR PDF runs on the same upload and the same account as the conversions because that is where it is needed.
این نرم‌افزار می‌تواند کتاب‌های الکترونیکی را بین فرمت‌های EPUB، MOBI، AZW3، PDF و DOCX منتقل کند و در نتیجه هر عنوانی که در هر سخت‌افزاری خوانده شود، قابل خواندن است. انجام این کار بعد از OCR PDF به این معنی است که تبدیل از نسخه ای که شما بر روی آن قرار گرفتید انجام می‌شود، نه از نسخه ای که هنوز در حال اصلاح بودید.
موتورها مشترک هستند - همان زنجیره ابزار، همان کارمندان، همان محدودیت‌ها. آنچه که سایت EPUB اضافه می‌کند یک دید از بازگشت به جریان است: کدام یک از این عملیات‌ها یک کتاب بازگشت به جریان را واقعاً پشتیبانی می‌کند، و کدام یک فقط در رسانه‌های طراحی ثابت در درون آن معنی دارد. همچنین از یک حقیقت در مورد قالب که این سایت نامیده می‌شود شروع می‌شود: کتاب یک zip از XHTML با یک بیانیه است ، بنابراین متن تقریبا هیچ هزینه ای ندارد و هر تصمیمی که مهم است در مورد تصاویر و زیر مجموعه های قلم است.
حسابی وجود ندارد ، و چیزی نگه داشته نمی‌شود: بارگذاری‌ها کمی پس از پایان کار از کارمندان حذف می‌شوند ، هیچ چیز خوانده نمی‌شود و هیچ چیز فهرست‌بندی نمی‌شود. حسابهای آزاد برای تاریخچه و اندازه دسته‌ای وجود دارند ، نه برای دسترسی.

به این ابزار امتیاز دهید

5.0/5 - 0 رای
وب‌گاه ns6.com -800+ دامنه. اسم کاملت رو پيدا کن
یا فایل‌های خود را اینجا رها کنید