CanDoYa
BN

ছবি থেকে লেখা কনভার্টার

পুরোটাই আপনার ব্রাউজারে চলে - কিছু আপলোড নেই, সাইন-আপ নেই।

শুরু করতে পরিষ্কার প্রিন্টেড লেখার ছবি দিন।

এই টুল শেয়ার করুন

ছবি থেকে লেখা কনভার্টার কীভাবে কাজ করে?

ছবি থেকে লেখা কনভার্টার অপটিক্যাল ক্যারেক্টার রিকগনিশন (OCR) ব্যবহার করে ছবিতে থাকা প্রিন্টেড অক্ষর শনাক্ত করে এবং সেটিকে সম্পাদনযোগ্য টেক্সটে রূপান্তর করে। এই টুলটি আপনার ব্রাউজারে Tesseract WebAssembly চালায়, যা CanDoYa-র ৪০টি লোকেলের ব্যবহৃত ভাষাগুলো কভার করে। ছবি কোথাও আপলোড হয় না-আপনি চাইলে ফলাফল কপি করতে বা TXT ফাইল হিসেবে ডাউনলোড করতে পারবেন।

যেভাবে ব্যবহার করবেন

  1. 1পরিষ্কার ছবি নির্বাচন করুন. JPEG, PNG, WebP, BMP বা non-animated GIF (সর্বোচ্চ ১৫ MB ও ২৪ মেগাপিক্সেল) ছবি দিন, অথবা ডেমো ছবি ব্যবহার করুন।
  2. 2লেখার ভাষা নির্বাচন করুন. ছবিতে যেই ভাষা লেখা আছে, সেটি বাছাই করুন। এক্সট্রাকশন শুরু হলে সেই ভাষার ডেটা ডাউনলোড হবে।
  3. 3লেখা বের করুন ও যাচাই করুন. OCR চালান, নাম-নম্বর ছবির সঙ্গে মিলিয়ে দেখুন, প্রয়োজনে সম্পাদনা করুন, তারপর কপি করুন বা UTF-8 TXT ফাইল হিসেবে ডাউনলোড করুন।

কাদের জন্য

এখানে ব্যবহৃত হয়েছে Tesseract.js 7, যা ওপেন সোর্স Tesseract OCR ইঞ্জিনের ব্রাউজার সংস্করণ। কোড, WebAssembly কোর এবং নির্বাচিত ভাষার ডেটা কেবলমাত্র এক্সট্রাকশন শুরু হলে লোড হয়। Tesseract নিজস্ব ব্যাকগ্রাউন্ড প্রসেসে কাজ করে, তাই ছবি প্রসেসিং চলাকালেও পেজ ব্যবহারযোগ্য থাকে।

OCR-এর নির্ভুলতা মূলত সোর্স ছবির মানের ওপর নির্ভরশীল। সোজা প্রিন্টেড লেখা, সমান আলো, স্পষ্ট ফোকাস, ভালো কনট্রাস্ট ও যথেষ্ট পিক্সেল ডিটেইল থাকলে ফল ভালো হয়। ছোট স্ক্রিনশট বড় করলে অনেক সময় উন্নতি হয়, আর তির্যক পৃষ্ঠা, অলঙ্কৃত ফন্ট, কলাম, হাতের লেখা, ঝলকানি বা ঝাপসা ছবিতে ম্যানুয়াল সংশোধন লাগতে পারে।

সাধারণ প্রশ্ন

আমার ছবি কি কোথাও আপলোড হয়?

না। নির্বাচিত ফাইলটি আপনার ডিভাইসেই Tesseract-এর ব্যাকগ্রাউন্ড প্রসেসে ডিকোড ও রিকগনাইজ হয়। ব্রাউজার শুধু পাবলিক OCR রানটাইম ও ভাষার ফাইল বাইরের হোস্ট থেকে ডাউনলোড করে, কিন্তু সেই অনুরোধে আপনার ছবি থাকে না। CanDoYa কখনো সোর্স ছবি বা এক্সট্রাক্টেড টেক্সট সংগ্রহ বা সংরক্ষণ করে না।

এই ছবি থেকে লেখা কনভার্টার কি ফ্রি?

হ্যাঁ। এখানে কোনো অ্যাকাউন্ট, পেমেন্ট, ওয়াটারমার্ক, পৃষ্ঠা ক্রেডিট বা ডাউনলোড ফি নেই। প্রসেসিং আপনার ডিভাইসেই হয়। প্রথমবার OCR ইঞ্জিন ও ভাষার ডেটা ডাউনলোডে ইন্টারনেট লাগবে, আর বড় ভাষার মডেল হলে মিটারড সংযোগে ডেটা খরচ বেশি হতে পারে।

কোন ছবি ফরম্যাট ও সাইজ এখানে চলে?

আপনি একবারে একটি JPEG, PNG, WebP, BMP বা non-animated GIF (সর্বোচ্চ ১৫ MB ও ২৪ মেগাপিক্সেল) প্রসেস করতে পারবেন। এই সীমাগুলো ফোন ও ল্যাপটপে মেমরি সমস্যা কমাতে রাখা হয়েছে। এখানে শুধু ছবি চলে; পুরো PDF পৃষ্ঠা পড়তে চাইলে আলাদা স্ক্যানড PDF OCR টুল ব্যবহার করুন।

ছবি থেকে লেখা বের করার নির্ভুলতা কেমন?

পরিষ্কার প্রিন্টেড লেখা হলে ভালো ফল পাওয়া যায়, তবে কোনো OCR-ই শতভাগ গ্যারান্টি দেয় না। স্পষ্ট ফোকাস, বড় অক্ষর, উচ্চ কনট্রাস্ট, সোজা পৃষ্ঠা ও সঠিক ভাষা দিলে নির্ভুলতা বাড়ে। হাতের লেখা, অস্বাভাবিক ফন্ট, ঝলকানি, ঝাপসা, টেবিল, কলাম বা মিশ্র পড়ার দিক থাকলে ভুল বা লাইন বদলাতে পারে।

হাতের লেখা কি বের করা যাবে?

খুব পরিষ্কার ব্লক-হাতের লেখায় কিছুটা কাজ করতে পারে, তবে এই টুল মূলত প্রিন্টেড টেক্সটের জন্য। হাতের লেখায় ভুল বেশি হতে পারে। গুরুত্বপূর্ণ শব্দ, তারিখ, সংখ্যা অবশ্যই ছবির সঙ্গে মিলিয়ে নিন।

কোন ভাষা নির্বাচন করব?

ছবিতে যেই ভাষার অক্ষর আছে, সেটাই বাছাই করুন; ব্রাউজারের ভাষা নয়। তালিকায় CanDoYa-র ৪০টি লোকেলের ব্যবহৃত সব ভাষা আছে, যেখানে সরল ও প্রচলিত চীনা আলাদা। পৃষ্ঠায় একাধিক ভাষা থাকলে প্রধান ভাষা দিন; একবারে একটি মডেলই চলে।

প্রথমবার এক্সট্রাকশনে বেশি সময় লাগছে কেন?

তখন ব্রাউজারকে প্রথমে Tesseract.js কোড, উপযুক্ত WebAssembly কোর ও নির্বাচিত ভাষার প্রশিক্ষিত ডেটা ডাউনলোড করতে হয়। পরে ক্যাশ থাকলে দ্রুত হবে, তবে প্রাইভেট মোড, স্টোরেজ ক্লিনআপ, নতুন ভাষা বা ক্যাশ মুছে গেলে আবার ডাউনলোড লাগতে পারে।

যাচাই না করে লেখা ব্যবহার করা যাবে?

প্রথমে অবশ্যই দেখে নিন-বিশেষ করে নাম, সংখ্যা, তারিখ, বিরামচিহ্ন ও দেখতে কাছাকাছি অক্ষর (যেমন O ও 0, l ও 1)। দেখানো confidence কেবল আনুমানিক; প্রতিটি শব্দ বা মূল চেহারা ঠিক থাকবে এমন নিশ্চয়তা দেয় না।