CanDoYa
TR

AI ile Dil Tespit Etme

Tümüyle tarayıcınızda çalışır - yükleme yok, üyelik yok.

Dilini belirlemek için bir cümle veya paragraf yapıştırın.

Metniniz tarayıcının ayrı çalışma sürecinde işlenir ve asla yüklenmez. Yalnızca herkese açık AI modeli indirilir.

Desteklenen 20 dil

Arapça, Bulgarca, Çince, Felemenkçe, İngilizce, Fransızca, Almanca, Yunanca, Hintçe, İtalyanca, Japonca, Lehçe, Portekizce, Rusça, İspanyolca, Svahili, Tayca, Türkçe, Urduca ve Vietnamca.

Başka bir dildeki metin, desteklenen en yakın seçenek olarak yanlış etiketlenebilir.

Bu aracı paylaş

Dil dedektörü nedir?

Dil dedektörü, yapıştırılan metnin büyük olasılıkla hangi dilde yazıldığını belirler. Bu araç örneği 20 dille karşılaştırır ve modelin en yüksek üç puanını gösterir. AI, tarayıcının ayrı çalışma sürecinde yerel olarak çalıştığı için metniniz yüklenmez. Ancak modelin ilk kullanımda indirilmesi gerekir.

Nasıl kullanılır

  1. 1Yeterli bir örnek yapıştırın. Desteklenen 20 dilden birinde tam bir cümle veya paragraf girin. Uzun ve doğal metni ayırt etmek, bir ad veya tek kelimeyi ayırt etmekten genellikle daha kolaydır.
  2. 2Cihazda tespiti çalıştırın. Dili tespit et düğmesine basın. İlk kullanımda modelin indirilmesini bekleyin. Önbellek hâlâ duruyorsa sonraki ziyaretlerde tarayıcı bu verileri yeniden kullanabilir.
  3. 3Sıralanmış sonuçları inceleyin. İlk sıradaki dili, ISO kodunu, puanı ve diğer seçenekleri kontrol edin. Birbirine yakın puanları, kısa örnekleri ve desteklenmeyen dilleri belirsiz kabul edin.

Kimler için

Dedektör, XLM-R sınıflandırma modelini cihazınızda çalıştırır. Sayfanın yanıt vermeye devam etmesi için çıkarım tarayıcının ayrı bir çalışma sürecinde yapılır. Önce WebGPU hızlandırması kullanılır, gerektiğinde WebAssembly CPU arka ucuyla yeniden denenir. İlk çalıştırmada Hugging Face üzerinden yaklaşık 296 MB model ve tokenizer verisi indirilir. Tarayıcı bu dosyaları normalde önbelleğe alır, ancak depolama temizlendiğinde veya boş alan azaldığında silebilir.

Model Arapça, Bulgarca, Çince, Felemenkçe, İngilizce, Fransızca, Almanca, Yunanca, Hintçe, İtalyanca, Japonca, Lehçe, Portekizce, Rusça, İspanyolca, Svahili, Tayca, Türkçe, Urduca ve Vietnamca dillerini karşılaştırır. Başka bir dildeki metin de bu etiketlerden birine zorlanır. Bu nedenle sonuca güvenmeden önce desteklenen diller listesini kontrol edin.

Sık sorulan sorular

Metnim bir sunucuya yükleniyor mu?

Hayır. Metin, tarayıcının içindeki ayrı çalışma sürecine aktarılır ve çıkarım cihazınızda gerçekleşir. Bu süreç herkese açık model dosyalarını ve Transformers.js çalışma ortamını dış sunuculardan indirir, ancak yapıştırdığınız metni bu isteklerle göndermez. CanDoYa örneği almaz veya saklamaz.

Dil dedektörü ücretsiz mi?

Evet. Hesap, ödeme, kredi sınırı veya API anahtarı gerekmez. Çıkarımı cihazınız yapar. İlk model indirmesi, yerel depolama alanı, bellek ve işlem süresi pratik maliyetlerdir. Kotalı internet bağlantısında model dosyalarının indirilmesi için veri ücreti uygulanabilir.

Ne kadar metin analiz edebilirim?

Normal uzunluktaki herhangi bir metni yapıştırabilirsiniz, ancak modelin giriş penceresinde kalmak ve tarayıcı çıkarım süresini öngörülebilir tutmak için yalnızca ilk 400 karakter analiz edilir. En az dört harf veya rakam gerekir. Kullanışlı bir sonuç için doğal ve tam bir cümle girin; bir paragraf modelin ayırt edebileceği daha fazla örüntü sağlar.

Metin hangi dilde? Araç hangi dilleri tanıyabilir?

Model 20 etiketi destekler: Arapça, Bulgarca, Çince, Felemenkçe, İngilizce, Fransızca, Almanca, Yunanca, Hintçe, İtalyanca, Japonca, Lehçe, Portekizce, Rusça, İspanyolca, Svahili, Tayca, Türkçe, Urduca ve Vietnamca. Bu kapalı kümenin dışındaki dilleri güvenilir biçimde tanıyamaz.

İlk indirme neden yaklaşık 296 MB?

Dedektör, küçük bir karakter sıklığı tablosu yerine çok dilli XLM-R sinir ağı modelini kullanır. Nicemlenmiş ONNX ağırlıkları yaklaşık 279 MB, tokenizer ise yaklaşık 17 MB boyutundadır. Tarayıcı genellikle ikisini de önbelleğe alır. Özel tarama, önbelleğin boşaltılması veya site verilerinin silinmesi yeniden indirmeyi gerektirebilir.

Dil tespiti WebGPU olmadan çalışır mı?

Evet. Tarayıcı WebGPU sağlıyorsa ayrı çalışma süreci önce onu kullanır. WebGPU yoksa veya model başlatılamazsa WebAssembly CPU arka ucuyla yeniden denenir. CPU çıkarımı metni yine cihazınızda tutar, ancak telefonlarda ve eski bilgisayarlarda yükleme ile tespit daha uzun sürebilir.

Güven puanları ne anlama gelir?

Puanlar, bu örnek için modelin seçebileceği 20 etiketi sıralar. Adayları karşılaştırmak için faydalıdır; doğruluk garantisi, bağımsız bir doğru olma olasılığı veya gerçek dilin desteklendiğine dair kanıt değildir. İlk iki puan birbirine yakınsa daha fazla doğal metin ekleyin.

Karma veya başka alfabeyle yazılmış metni algılayabilir mi?

Araç her cümle ya da kelime için ayrı etiket vermek yerine en baskın eşleşmeyi ve alternatifleri döndürür. Karma dilli metinlerde puanlar birbirine yaklaşabilir. Gayriresmî çevriyazı, adlar, emoji, URL ve kaynak kodu da alfabe ile yazım ipuçlarını azaltır; bu sonuçları dikkatli biçimde insan gözüyle inceleyin.