CanDoYa
TH

ตรวจสอบภาษาด้วย AI

ทำงานในเบราว์เซอร์ทั้งหมด ไม่ต้องอัปโหลด ไม่ต้องสมัครสมาชิก

วางประโยคหรือย่อหน้าเพื่อระบุภาษา

ข้อความถูกประมวลผลในเวิร์กเกอร์ของเบราว์เซอร์และไม่เคยถูกอัปโหลด มีเพียงโมเดล AI สาธารณะที่ถูกดาวน์โหลด

รองรับ 20 ภาษา

อาหรับ บัลแกเรีย จีน ดัตช์ อังกฤษ ฝรั่งเศส เยอรมัน กรีก ฮินดี อิตาลี ญี่ปุ่น โปแลนด์ โปรตุเกส รัสเซีย สเปน สวาฮีลี ไทย ตุรกี อูรดู และเวียดนาม

ข้อความภาษาอื่นอาจถูกระบุผิดเป็นภาษาที่รองรับซึ่งใกล้เคียงที่สุด

แชร์เครื่องมือนี้

เครื่องมือตรวจสอบภาษาคืออะไร?

เครื่องมือตรวจสอบภาษาจะหาว่าข้อความที่วางไว้น่าจะเป็นภาษาใดมากที่สุด เครื่องมือนี้เปรียบเทียบตัวอย่างกับ 20 ภาษาและแสดงคะแนนของโมเดล 3 อันดับแรก AI ทำงานภายในเวิร์กเกอร์ของเบราว์เซอร์ ข้อความจึงไม่ถูกอัปโหลด แต่ต้องดาวน์โหลดโมเดลเมื่อใช้งานครั้งแรก

วิธีใช้งาน

  1. 1วางตัวอย่างที่มีเนื้อหาเพียงพอ. ใส่ประโยคเต็มหรือย่อหน้าในหนึ่งใน 20 ภาษาที่รองรับ ข้อความธรรมชาติที่ยาวกว่ามักแยกภาษาได้ง่ายกว่าชื่อหรือคำเดี่ยว
  2. 2ตรวจจับภาษาบนอุปกรณ์. กดตรวจสอบภาษา หากใช้งานครั้งแรกให้รอการดาวน์โหลดโมเดล ครั้งต่อไปสามารถใช้แคชของเบราว์เซอร์ได้หากไฟล์ยังอยู่
  3. 3ตรวจผลลัพธ์ตามลำดับ. ดูภาษาที่ได้อันดับแรก รหัส ISO คะแนน และตัวเลือกอื่น หากคะแนนใกล้กัน ข้อความสั้น หรือภาษาไม่อยู่ในรายการที่รองรับ ควรถือว่าผลยังไม่แน่นอน

เหมาะกับใคร

เครื่องมือนี้ใช้โมเดลจำแนกภาษา XLM-R บนอุปกรณ์ และประมวลผลในเวิร์กเกอร์เพื่อให้หน้าเว็บยังตอบสนองได้ตามปกติ ระบบจะเลือกใช้ WebGPU ก่อน และเปลี่ยนไปใช้ WebAssembly บน CPU หากจำเป็น การใช้งานครั้งแรกต้องดาวน์โหลดโมเดลและโทเคไนเซอร์จาก Hugging Face ประมาณ 296 MB โดยทั่วไปเบราว์เซอร์จะเก็บไฟล์เหล่านี้ไว้ในแคช แต่อาจลบออกเมื่อมีการล้างพื้นที่จัดเก็บหรือพื้นที่เหลือน้อย

โมเดลเปรียบเทียบได้เฉพาะภาษาอาหรับ บัลแกเรีย จีน ดัตช์ อังกฤษ ฝรั่งเศส เยอรมัน กรีก ฮินดี อิตาลี ญี่ปุ่น โปแลนด์ โปรตุเกส รัสเซีย สเปน สวาฮีลี ไทย ตุรกี อูรดู และเวียดนาม ข้อความภาษาอื่นจะถูกบังคับให้ตรงกับหนึ่งในป้ายกำกับเหล่านี้ จึงควรตรวจสอบรายชื่อภาษาที่รองรับก่อนนำผลไปใช้

คำถามที่พบบ่อย

ข้อความของฉันถูกอัปโหลดไปยังเซิร์ฟเวอร์หรือไม่?

ไม่ ข้อความจะถูกส่งไปยังเวิร์กเกอร์ภายในเบราว์เซอร์และประมวลผลบนอุปกรณ์ เวิร์กเกอร์ดาวน์โหลดไฟล์โมเดลสาธารณะและรันไทม์ Transformers.js จากโฮสต์ภายนอก แต่คำขอเหล่านั้นไม่ได้ส่งข้อความที่วางไว้ CanDoYa ไม่ได้รับหรือจัดเก็บตัวอย่างข้อความ

เครื่องมือตรวจสอบภาษาใช้ฟรีหรือไม่?

ใช้ฟรี ไม่ต้องมีบัญชี ชำระเงิน ซื้อเครดิต หรือใช้คีย์ API อุปกรณ์ของคุณเป็นผู้ประมวลผล ค่าใช้จ่ายที่ควรคำนึงถึงคือการดาวน์โหลดโมเดลครั้งแรก พื้นที่จัดเก็บ หน่วยความจำ และเวลาในการทำงาน หากใช้อินเทอร์เน็ตแบบคิดตามปริมาณ ผู้ให้บริการอาจคิดค่าดาวน์โหลดไฟล์โมเดล

วิเคราะห์ข้อความได้ยาวแค่ไหน?

วางข้อความทั่วไปได้ แต่เครื่องมือจะวิเคราะห์เฉพาะ 400 อักขระแรกเพื่อให้อยู่ในขอบเขตอินพุตของโมเดลและควบคุมเวลาประมวลผลในเบราว์เซอร์ ต้องมีตัวอักษรหรือตัวเลขอย่างน้อย 4 ตัว หากต้องการผลที่ใช้งานได้ควรใส่ประโยคธรรมชาติอย่างน้อยหนึ่งประโยค และย่อหน้าจะช่วยให้โมเดลเห็นรูปแบบที่แยกภาษาได้มากขึ้น

เครื่องมือนี้ตรวจจับภาษาใดได้บ้าง?

โมเดลรองรับ 20 ป้ายกำกับ ได้แก่ ภาษาอาหรับ บัลแกเรีย จีน ดัตช์ อังกฤษ ฝรั่งเศส เยอรมัน กรีก ฮินดี อิตาลี ญี่ปุ่น โปแลนด์ โปรตุเกส รัสเซีย สเปน สวาฮีลี ไทย ตุรกี อูรดู และเวียดนาม ภาษาอื่นนอกชุดนี้จะระบุได้ไม่แม่นยำ

ทำไมการดาวน์โหลดครั้งแรกจึงมีขนาดประมาณ 296 MB?

เครื่องมือนี้ใช้โครงข่ายประสาท XLM-R หลายภาษาแทนตารางความถี่อักขระขนาดเล็ก น้ำหนัก ONNX ที่บีบอัดแล้วมีขนาดประมาณ 279 MB และโทเคไนเซอร์ประมาณ 17 MB โดยทั่วไปเบราว์เซอร์จะเก็บทั้งสองอย่างไว้ในแคช แต่โหมดส่วนตัว การล้างข้อมูลเว็บไซต์ หรือการลบแคชอาจทำให้ต้องดาวน์โหลดใหม่

ตรวจจับภาษาได้หรือไม่หากไม่มี WebGPU?

ได้ เวิร์กเกอร์จะเลือก WebGPU เมื่อเบราว์เซอร์รองรับ หากไม่มี WebGPU หรือเริ่มโมเดลไม่สำเร็จ เครื่องมือจะลองใหม่ด้วย WebAssembly บน CPU ข้อความยังคงอยู่บนอุปกรณ์เหมือนเดิม แต่การโหลดและตรวจจับอาจใช้เวลานานขึ้นในโทรศัพท์หรือคอมพิวเตอร์รุ่นเก่า

คะแนนความมั่นใจหมายถึงอะไร?

คะแนนใช้จัดอันดับป้ายกำกับ 20 ภาษาที่โมเดลพิจารณาสำหรับตัวอย่างนี้ เหมาะสำหรับเปรียบเทียบตัวเลือก แต่ไม่ใช่การรับประกัน ไม่ใช่ความน่าจะเป็นอิสระว่าคำตอบถูก และไม่ได้ยืนยันว่าภาษาจริงอยู่ในชุดที่รองรับ หากคะแนนอันดับต้นใกล้กันควรเพิ่มข้อความธรรมชาติให้มากขึ้น

ตรวจจับข้อความหลายภาษาหรือข้อความถอดเสียงได้ไหม?

เครื่องมือจะคืนภาษาหลักหนึ่งรายการพร้อมตัวเลือกอื่น ไม่ได้ให้ป้ายกำกับแยกทุกประโยคหรือทุกคำ ข้อความหลายภาษาอาจได้คะแนนใกล้กัน ส่วนการถอดเสียงแบบไม่เป็นทางการ ชื่อ อีโมจิ URL และซอร์สโค้ดทำให้เบาะแสด้านอักษรและการสะกดลดลง จึงควรตรวจทานผลด้วยคน