শনাক্তকারী আপনার ডিভাইসে একটি XLM-R শ্রেণিবিন্যাস মডেল চালায় এবং পেজ সচল রাখতে worker-এ inference করে। এটি আগে WebGPU acceleration ব্যবহারের চেষ্টা করে, প্রয়োজন হলে WebAssembly CPU backend দিয়ে আবার চেষ্টা করে। প্রথমবার প্রায় ২৯৬ MB মডেল ও tokenizer data Hugging Face থেকে ডাউনলোড হয়। ব্রাউজার সাধারণত ফাইলগুলো cache-এ রাখে, তবে storage পরিষ্কার করলে বা জায়গা কম থাকলে সেগুলো মুছে যেতে পারে।
মডেলটি আরবি, বুলগেরীয়, চীনা, ডাচ, ইংরেজি, ফরাসি, জার্মান, গ্রিক, হিন্দি, ইতালীয়, জাপানি, পোলিশ, পর্তুগিজ, রুশ, স্প্যানিশ, সোয়াহিলি, থাই, তুর্কি, উর্দু ও ভিয়েতনামি ভাষা তুলনা করে। অন্য ভাষার টেক্সটও এই লেবেলগুলোর একটির দিকে জোর করে ঠেলে দেওয়া হয়, তাই ফলাফলের ওপর নির্ভর করার আগে সমর্থিত ভাষার তালিকা দেখে নিন।