1স্ক্যান করা PDF documents আপলোড করুন; একটি পরিষ্কার ৩০০ DPI গ্রেস্কেল স্ক্যান সনাক্তকারীকে কাজ করার জন্য সর্বাধিক সুযোগ দেয়।
2কোন ভাষার কথা বলুন, যা আপনি আশা করছেন - ভাষার নাম বলুন, নাকি তাকে আন্দাজ করতে দিন।
3সনাক্তকরণ পাস চালাও; শব্দগুলি মূল পৃষ্ঠার ছবির উপর একটি অদৃশ্য স্তর হিসাবে লিখে ফেলা হয়।
4অনুসন্ধানযোগ্য PDF ফাইল ডাউনলোড করুন - এটি একই রকম দেখায়, কিন্তু এখন আপনি এটিতে অনুসন্ধান এবং টেক্সট নির্বাচন করতে পারেন।
OCR PDF প্রায়শই জিজ্ঞাসিত প্রশ্নাবলী
সবচেয়ে ভালো ফলাফল পেতে আমি কিভাবে স্ক্যান করব?
+
গ্রেট স্কেল- এ ৩০০ ডিপিআই হল সুস্বাদু স্থান । ২০০ ডিপিআই এর নিচে অক্ষর আকৃতির গঠন বিঘ্নিত হতে শুরু করে; ৪০০ ডিপিআই এর উপরে আপনি প্রায় কিছুই লাভ করেন না এবং এর জন্য ফাইল মাপ এবং প্রসেসিং সময়ের খরচ হয় ।
OCR PDF কিভাবে স্ক্যান করা তথ্যকে টেক্সটে রূপান্তর করে?
+
বিশেষ করে, প্রতিটি পৃষ্ঠাকে রেন্ডার করা হয়, টেসরাক্ট টেক্সট-রিকগনিশন পাস দিয়ে ১০০টিরও বেশি ভাষায় চালানো হয়, এবং সনাক্তকৃত শব্দগুলোকে মূল ছবির উপরে অদৃশ্য টেক্সট স্তর হিসেবে লিখে ফেলা হয়- তাই পৃষ্ঠাটি অদলবদলহীন দেখায় কিন্তু অনুসন্ধানযোগ্য এবং নির্বাচনযোগ্য।। পাতা এখনও ঠিক তেমনই দেখাচ্ছে যেমনটা ছিল - ছবির পিছনে স্বীকৃত লেখা অদৃশ্যভাবে বসেছে, তাই অনুসন্ধান এবং নির্বাচনের কাজ দেখার ধরন পরিবর্তন না করেই করা যায়।
PDF এর জন্য এখানে কিছু নির্দিষ্ট আছে?
+
হ্যাঁ — PDF একটি বস্তু গ্রাফ, একটি পৃষ্ঠা ছবি নয়, তাই টেক্সট নির্বাচনযোগ্য এবং ভেক্টরগুলো স্পষ্ট থাকে, এর ভেতরের রাস্টার বিষয়বস্তুতে যা ঘটে তা না দেখে । এটি সনাক্তকারীর দ্বারা দেখার বিষয়টিকে প্রভাবিত করে।
এটা কতটা সঠিক?
+
মুদ্রণকৃত লেখার একটি পরিষ্কার ৩০০ ডিপিআই স্ক্যানের ক্ষেত্রে, যথেষ্ট উচ্চ যে ভুল বিরল এবং বেশিরভাগই অসাধারণ নামের ক্ষেত্রে। সঠিকতা নিম্ন রেজোলিউশন, ঝুঁকি, ফোন ক্যামেরা থেকে ছায়া, অসাধারণ টাইপফেস এবং হাতের লেখার সাথে দ্রুত কমে যায় - বিশেষ করে হাতের লেখার জন্য এটি বিশেষভাবে উপযোগী নয়।
OCR PDF-এ আমি কি আপলোড করতে পারি?
+
যেকোন আদর্শ PDF, স্ক্যানার, ওয়ার্ড প্রসেসর অথবা মুদ্রণ ড্রাইভার দ্বারা তৈরি ফাইল সহ। সম্পাদন করার জন্য পাসওয়ার্ড ব্যবহার করে ফাইলগুলি হ্যান্ডেল করা হয়; যে ফাইলগুলি খোলার জন্য ব্যবহারকারীর পাসওয়ার্ড প্রয়োজন, সেগুলি হ্যান্ডেল করা হয় না এবং এনক্রিপশন ভেঙ্গে ফেলার চেষ্টা করা হয় না।
OCR PDF-এ ফাইলের মাপের সীমা কি রয়েছে?
+
হ্যাঁ: ফ্রি অ্যাকাউন্টগুলো 5 MB টি নথি প্রক্রিয়াজাত করে, যা অধিকাংশ রিপোর্ট এবং চুক্তিকে আবৃত করে কিন্তু ৬০০ ডিপিআই-এ দীর্ঘ স্ক্যান করা নথিকে নয়; ghostscript এবং qpdf কাজটি করে। স্ক্যান করা PDF-এর আকার সাধারণত এর চেয়ে বেশি, এবং নথিটি প্রথমে সংকুচিত করা হলে তা পুনরায় নিচে নিয়ে আসার জন্য সাধারণত যথেষ্ট।
OCR PDF কি আমার PDF documents-এর গুণমান কমিয়ে দেবে?
+
টেক্সট এবং ভেক্টর চিত্রকর্ম পিক্সেলের পরিবর্তে বস্তু, তাই তারা যে কোন বড় আকারে কোন কিছু ঘটে তা সত্ত্বেও তারা চমৎকারভাবে চকচকে থাকে। শুধুমাত্র অন্তর্ভুক্ত রাস্টার ছবি হ্রাস করা যেতে পারে, এবং শুধুমাত্র যদি আপনি তাদের পুনরায় স্যাম্পল করেন।
আমি কি একই সময়ে OCR PDF-কে বেশ কয়েকটি PDF documents-এ চালাতে পারি?
+
হ্যাঁ — সেট আপলোড করুন এবং তারা একই সাথে একই সেটিংসে প্রক্রিয়া করবে, যা ডেস্কটপ রিডার ব্যবহার করে ক্লিক করার পরিবর্তে এখানে নথির কাজের প্রবাহের জন্য উপযুক্ত।
EPUB সাইট OCR PDF হোস্ট করে কেন?
+
EPUB.to is built around the open eBook format — XHTML in a zip, reflowable by design, and readable on hardware nobody has thought about the layout for. একটি বই হল একটি জিপ ফাইল, যা পূর্ণ মারকআপ, ছবি এবং ফন্ট দিয়ে ভরা, তাই প্রায় প্রতিটি কাজ যা মানুষ ই-বই সাইটে নিয়ে আসে তা আসলে এই সব কিছুর একটি কাজ। OCR PDF একই আপলোড এবং একই অ্যাকাউন্টে চলে, যেমনটা রূপান্তর করা হয়, কারণ সেখানেই এর প্রয়োজন।
OCR PDF শেষ হলে ফলাফল নিয়ে আমি কি করব?
+
এই সাইটের কনভার্টার ইপাব, মোবি, এজডব্লিউ৩, পিডিএফ এবং ডকএক্স এর মধ্যে বই সরিয়ে দেয়, যাতে কোন বই যে কোন হার্ডওয়্যারের মাধ্যমে পড়তে পারে। OCR PDF এর পর তা করা হলে অর্থ হল আপনি যে সংস্করণে কাজ করেছেন, সেটি থেকে রূপান্তর করা হবে, আপনি যে সংস্করণটি ঠিক করতে চেয়েছিলেন তা থেকে নয়।
OCR PDF এখানে কি ভাই বোন সাইটগুলির একই টুল চালানো হচ্ছে?
+
ইঞ্জিনগুলো একই - একই টুলচেইন, একই কর্মী, একই সীমাবদ্ধতা। EPUB সাইটটি যেটা যোগ করে তা হল রিফ্লো-এর একটি দৃষ্টিভঙ্গি: এই অপারেশনগুলোর মধ্যে কোনটি একটি রিফ্লো-যোগ্য বই সত্যিই সমর্থন করে, আর কোনটি শুধুমাত্র এর মধ্যে স্থির-লেআউট মিডিয়াতে বুঝা যায়। এটি একই সাথে এই সাইটের নামকরণ ফরম্যাট সম্পর্কে একটি সত্য থেকে শুরু হয়: বইটি একটি এক্সএইচটিএমএলের জিপ যা একটি ম্যানিফেস্টের সাথে যুক্ত, তাই লেখার খরচ প্রায় কিছুই হয় না এবং সব সিদ্ধান্তই যে গুরুত্বপূর্ণ তা হচ্ছে ছবি এবং ফন্ট সাবসেট এর অন্তর্ভুক্ত করা।।
আমার কি কোন অ্যাকাউন্ট লাগবে, আর কিছুই কি রাখা হবে না?
+
কোন অ্যাকাউন্ট নেই, এবং কিছুই রাখা হয় না: কাজ শেষ হওয়ার পর আপলোড করা ফাইলগুলো কর্মীদের থেকে মুছে ফেলা হয়, কিছুই পড়া হয় না এবং কিছুই সূচীভুক্ত করা হয় না। মুক্ত অ্যাকাউন্টসমূহ ইতিহাস এবং ব্যাচ মাপের জন্য রয়েছে, ব্যবহারের জন্য নয়।