CanDoYa
BN

সেন্টিমেন্ট অ্যানালাইসিস ফ্রি অনলাইন টুল

সীমিত ভাষা

পুরোটাই আপনার ব্রাউজারে চলে - কিছু আপলোড নেই, সাইন-আপ নেই।

কোনো ফিডব্যাক, রিভিউ বা সোশ্যাল পোস্ট পেস্ট করে তার টোন বিশ্লেষণ করুন।

আপনার লেখা ব্রাউজারের একটি ওয়ার্কারে প্রসেস হয় এবং কখনও আপলোড করা হয় না। প্রথমবার পাবলিক AI মডেলটি ডাউনলোড হয়।

তিনটি সামগ্রিক সেন্টিমেন্ট লেবেল

নেগেটিভ মানে অননুকূল টোন, নিউট্রাল মানে স্পষ্ট পজিটিভ বা নেগেটিভ ঝোঁক নেই, আর পজিটিভ মানে অনুকূল টোন।

সেন্টিমেন্টের জন্য ফাইন-টিউন করা ভাষা: আরবি, ইংরেজি, ফরাসি, জার্মান, হিন্দি, ইতালিয়ান, পর্তুগিজ ও স্প্যানিশ।

সোশ্যাল পোস্ট থেকে শেখা মডেল। ব্যঙ্গ, মিশ্র অনুভূতি, বিশেষজ্ঞভিত্তিক ভাষা বা প্রশিক্ষণভুক্ত নয় এমন ভাষায় লেখা সহজেই ভুল লেবেল পেতে পারে।

এই টুল শেয়ার করুন

সেন্টিমেন্ট অ্যানালাইসিস কী?

সেন্টিমেন্ট অ্যানালাইসিস মানে একটি লেখার সামগ্রিক মনোভাব বা টোনকে নেগেটিভ, নিউট্রাল বা পজিটিভ হিসাবে শ্রেণিবদ্ধ করা। এই টুলটি আপনার ব্রাউজারের ভেতরেই একটি মাল্টিলিঙ্গুয়াল XLM-T মডেল চালায় এবং প্রতিটি লেবেলের স্কোর আলাদা করে দেখায়। টেক্সটটি ব্রাউজারের ভেতরেই থাকে, যদিও প্রথমবার বিশ্লেষণ চালানোর সময় পাবলিক মডেলটি ডাউনলোড হয়।

যেভাবে ব্যবহার করবেন

  1. 1একটি কার্যকর নমুনা পেস্ট করুন. কোনো রিভিউ, কমেন্ট, মেসেজ বা সোশ্যাল পোস্ট লিখে বা পেস্ট করে দিন। একক শব্দের চেয়ে সম্পূর্ণ একটি বাক্য দিলে মডেল বেশি প্রাসঙ্গিক তথ্য পায়।
  2. 2লোকাল মডেল চালান. সেন্টিমেন্ট বিশ্লেষণ করুন বোতামে ক্লিক করুন। প্রথমবার মডেল ডাউনলোড শেষ হওয়া পর্যন্ত অপেক্ষা করুন; পরে ব্রাউজারের ক্যাশে ঠিক থাকলে একই মডেল বারবার ব্যবহার করা যাবে।
  3. 3তিনটি স্কোরই পড়ুন. শীর্ষ লেবেলটিকে মোটামুটি ইঙ্গিত হিসেবে দেখুন এবং তার স্কোর অন্য দুটির সঙ্গে মিলিয়ে নিন। স্কোরগুলো খুব কাছাকাছি থাকলে মানুষের হাতে পর্যালোচনা করা বেশি নিরাপদ, পরিষ্কার সিদ্ধান্ত ধরে নেওয়া ঠিক নয়।

কাদের জন্য

এই সেন্টিমেন্ট অ্যানালাইজার Cardiff NLP XLM-T মডেল ব্যবহার করে, যেটি প্রায় ১৯৮ মিলিয়ন মাল্টিলিঙ্গুয়াল টুইটে ট্রেইন করা একটি XLM-R সিস্টেম এবং সেন্টিমেন্ট কাজের জন্য আরবি, ইংরেজি, ফরাসি, জার্মান, হিন্দি, ইতালিয়ান, পর্তুগিজ ও স্প্যানিশ ভাষায় ফাইন-টিউন করা। আউটপুট লেবেলগুলো মানে হল সামগ্রিকভাবে অননুকূল টোন, কোনো স্পষ্ট নেগেটিভ বা পজিটিভ ঝোঁক না থাকা টোন, এবং সামগ্রিকভাবে অনুকূল টোন। এগুলো নির্দিষ্ট আবেগ, সত্যতা, জরুরিতা বা লেখকের উদ্দেশ্য শনাক্ত করে না। এই পাতার ভাষা বাংলা, যা ফাইন-টিউন করা আটটি ভাষার মধ্যে নেই, তাই বাংলায় প্রাপ্ত ফলাফলগুলোকে আনুমানিক হিসেবে ধরুন, যদিও মাল্টিলিঙ্গুয়াল বেস মডেল একটি লেবেল ফেরত দিতে পারে।

প্রথমবার বিশ্লেষণ চালানোর সময় প্রায় ২৯৭ MB আকারের কোয়ান্টাইজড ONNX মডেল ওজন এবং টোকেনাইজার ফাইল ডাউনলোড হয়। একটি ব্রাউজার ওয়ার্কার মূল UI থ্রেডের বাইরে ইনফারেন্স চালায়। যেখানে সম্ভব WebGPU ব্যবহার করা হয়, আর সেটি না থাকলে বা শুরু হতে ব্যর্থ হলে WebAssembly ভিত্তিক CPU ব্যাকএন্ড ধীর বিকল্প হিসেবে চলে। সাধারণত ব্রাউজার এই ফাইলগুলো ক্যাশে রাখে, তবে প্রাইভেট ব্রাউজিং, স্টোরেজ পরিষ্কার করা বা কম ডিস্ক স্পেসের কারণে আবার ডাউনলোড লাগতে পারে।

সাধারণ প্রশ্ন

আমার লেখা কি সার্ভারে আপলোড হয়?

না। আপনার লেখা ব্রাউজারের ভেতরের একটি ওয়ার্কারে পাঠানো হয় এবং মডেলটি আপনার ডিভাইসেই চলে। ওয়ার্কারটি বাইরের হোস্ট থেকে পাবলিক Transformers.js রানটাইম এবং মডেল ফাইলগুলো ডাউনলোড করে, কিন্তু ওই অনুরোধগুলোর মধ্যে আপনার পেস্ট করা টেক্সট থাকে না। CanDoYa আপনার নমুনা গ্রহণ বা সংরক্ষণ করে না।

এই সেন্টিমেন্ট অ্যানালাইসিস টুল কি ফ্রি?

হ্যাঁ। এখানে কোনো অ্যাকাউন্ট, পেমেন্ট, API কী বা বিশ্লেষণের কোটার প্রয়োজন নেই। পুরো কাজটাই আপনার ডিভাইস করে। বাস্তবে খরচ বলতে প্রথম মডেল ডাউনলোড, লোকাল ব্রাউজার স্টোরেজ, মেমরি এবং প্রসেসিং সময় লাগে। মডেল ডাউনলোডের ডেটার জন্য আপনার নেটওয়ার্ক প্রোভাইডার আলাদা চার্জ নিতে পারে।

আমি কতটা লেখা বিশ্লেষণ করতে পারি?

আপনি স্বাভাবিক কোনো অনুচ্ছেদ বা অংশ পেস্ট করতে পারেন, তবে ব্রাউজারের ইনফারেন্স পূর্বানুমানযোগ্য রাখতে টুল সর্বোচ্চ প্রথম ১,০০০টি ইউনিকোড ক্যারেক্টার বিশ্লেষণ করে। মডেলের টোকেনাইজারও তার ইনপুট উইন্ডো পর্যন্তই টেক্সট রাখে, বাকিটা কেটে দেয়। বড় ডকুমেন্টের জন্য একেকটি অর্থপূর্ণ অংশ আলাদা করে বিশ্লেষণ করুন, একটিমাত্র লেবেলকে পুরো ডকুমেন্টের সারাংশ ধরে নেবেন না।

মডেলটি কোন কোন ভাষায় সেন্টিমেন্ট সাপোর্ট করে?

সেন্টিমেন্ট ফাইন-টিউন করা হয়েছে আরবি, ইংরেজি, ফরাসি, জার্মান, হিন্দি, ইতালিয়ান, পর্তুগিজ ও স্প্যানিশ ভাষায়। মাল্টিলিঙ্গুয়াল বেস মডেল অন্য ভাষার জন্যও লেবেল ফেরত দিতে পারে, কিন্তু সেগুলোর পেছনে একই রকম টাস্ক-নির্দিষ্ট প্রশিক্ষণ প্রমাণ নেই। এই কারণে বাংলা সহ অন্যান্য CanDoYa লোকেলে ফলাফলগুলোকে আনুমানিক হিসেবে চিহ্নিত করা হয়েছে।

নেগেটিভ, নিউট্রাল এবং পজিটিভ মানে ঠিক কী?

নেগেটিভ মানে মডেলের মতে লেখা সামগ্রিকভাবে অননুকূল বা নেতিবাচক টোনে রয়েছে। নিউট্রাল মানে স্পষ্ট পজিটিভ বা নেগেটিভ কোনোটাই জোরালো নয়। পজিটিভ মানে সামগ্রিকভাবে অনুকূল বা ইতিবাচক টোন। এই লেবেলগুলো পুরো নমুনা টেক্সটের উপরে প্রযোজ্য, আলাদা আলাদা বাক্য নয়, আর এগুলো আবেগের ক্যাটাগরি নয় এবং লেখক আসলে কী বিশ্বাস করেন বা কী করতে চান তা প্রমাণ করে না।

মডেলের স্কোরগুলো কী বোঝায়?

তিনটি স্কোর এই ইনপুটের জন্য নেগেটিভ, নিউট্রাল ও পজিটিভ লেবেলের আপেক্ষিক অবস্থান দেখায় এবং সাধারণত মোট যোগফল প্রায় ১০০ শতাংশের কাছাকাছি হয়। এগুলো মডেলের ভেতরে তিনটি লেবেল তুলনা করার জন্য উপকারী, কিন্তু এগুলো শতভাগ সঠিকতার গ্যারান্টিযুক্ত বা ক্যালিব্রেটেড প্রোবাবিলিটি নয়। স্কোর যতই বেশি দেখাক, টেক্সট যদি ট্রেইনিং ডোমেইনের বাইরে হয় তবুও লেবেল ভুল হতে পারে।

প্রথম ডাউনলোড প্রায় ২৯৭ MB কেন?

টুলটি প্রায় ২৭৯ MB আকারের কোয়ান্টাইজড XLM-R ONNX ওজন এবং প্রায় ১৭ MB টোকেনাইজার ডেটা ব্যবহার করে। এটি স্রেফ কোনো শব্দতালিকার চেয়ে অনেক বড়, কিন্তু এর মাধ্যমে শুধু পজিটিভ বা নেগেটিভ শব্দ গোনার বদলে প্রসঙ্গভিত্তিক ভাষার প্যাটার্ন ধরা যায়। সাধারণত প্রথম রান শেষে ব্রাউজার এগুলো ক্যাশে রাখে, যদিও সব ব্রাউজারে বা সব অবস্থায় ক্যাশ থাকা নিশ্চিত নয়।

WebGPU ছাড়াও কি অ্যানালাইজার কাজ করবে?

হ্যাঁ। ব্রাউজার ও গ্রাফিক্স অ্যাডাপ্টার WebGPU সাপোর্ট করলে ওয়ার্কার আগে সেটাই ব্যবহার করার চেষ্টা করে। ওই পথটি না থাকলে বা শুরু হতে ব্যর্থ হলে টুল WebAssembly ভিত্তিক CPU ব্যাকএন্ডে আবার চেষ্টা করে। CPU মোডেও একই মডেল চলে এবং টেক্সট লোকালই থাকে, তবে লোড হতে ও ইনফারেন্স চালাতে বেশি সময় লাগতে পারে।