CanDoYa
SR

AI prepoznavanje jezika

Ograničeni jezici

Radi u celosti u pregledaču - bez otpremanja i bez registracije.

Nalepite rečenicu ili pasus da biste prepoznali jezik.

Tekst se obrađuje u zasebnom procesu pregledača i nikada se ne šalje. Preuzima se samo javni AI model.

20 podržanih jezika

Arapski, bugarski, kineski, holandski, engleski, francuski, nemački, grčki, hindi, italijanski, japanski, poljski, portugalski, ruski, španski, svahili, tajlandski, turski, urdu i vijetnamski.

Tekst na drugom jeziku može biti pogrešno označen kao najsličnija podržana mogućnost.

Podelite ovu alatku

Kako radi prepoznavanje jezika?

Prepoznavanje jezika određuje najverovatniji jezik nalepljenog teksta. Ovaj alat poredi uzorak sa 20 jezika i prikazuje tri najviše ocene modela. AI radi lokalno u zasebnom procesu pregledača, pa se tekst ne šalje na server, iako model mora da se preuzme pri prvoj upotrebi.

Kako se koristi

  1. 1Nalepite koristan uzorak. Unesite celu rečenicu ili pasus na jednom od 20 podržanih jezika. Duži, prirodan tekst obično je lakše razlikovati od imena ili jedne reči.
  2. 2Pokrenite prepoznavanje na uređaju. Kliknite Prepoznaj jezik. Pri prvom pokretanju sačekajte preuzimanje modela. Pri kasnijim posetama alat može ponovo da koristi keš pregledača ako je još dostupan.
  3. 3Pregledajte rangirane rezultate. Proverite vodeći jezik, ISO oznaku, ocenu i druge mogućnosti. Bliske ocene, kratke uzorke i nepodržane jezike smatrajte nepouzdanim.

Kome je namenjen

Alat pokreće klasifikacioni model XLM-R na vašem uređaju, a zaključivanje obavlja u zasebnom procesu kako bi stranica ostala brza. Prvo koristi WebGPU ubrzanje, a po potrebi pokušava ponovo putem procesorske pozadine WebAssembly. Pri prvom pokretanju preuzima se oko 296 MB podataka modela i tokenizatora sa Hugging Facea. Pregledač ih obično čuva u kešu, ali može da ih ukloni kada obrišete podatke ili ponestane prostora.

Model poredi arapski, bugarski, kineski, holandski, engleski, francuski, nemački, grčki, hindi, italijanski, japanski, poljski, portugalski, ruski, španski, svahili, tajlandski, turski, urdu i vijetnamski. Tekst na drugom jeziku biće svrstan pod jednu od tih oznaka, zato proverite listu podržanih jezika pre nego što se oslonite na rezultat.

Česta pitanja

Da li se moj tekst šalje na server?

Ne. Tekst se prosleđuje zasebnom procesu u pregledaču, a obrada se odvija na vašem uređaju. Taj proces preuzima javne datoteke modela i okruženje Transformers.js sa spoljnih servera, ali uz te zahteve ne šalje nalepljeni tekst. CanDoYa ne prima niti čuva uzorak.

Da li je prepoznavanje jezika besplatno?

Da. Nisu potrebni nalog, plaćanje, kreditno ograničenje ni API ključ. Obradu izvršava vaš uređaj. Stvarni troškovi su prvo preuzimanje modela, lokalni prostor, memorija i vreme obrade. Ako se internet veza naplaćuje prema potrošnji, preuzimanje datoteka modela može dodatno da se naplati.

Koliko teksta mogu da analiziram?

Možete da nalepite uobičajen tekst bilo koje dužine, ali alat analizira najviše prvih 400 znakova kako bi ostao unutar ulaznog prozora modela i zadržao predvidivu obradu u pregledaču. Potrebna su najmanje četiri slova ili broja. Za koristan rezultat unesite bar jednu prirodnu rečenicu, a pasus modelu daje više prepoznatljivih obrazaca.

Koje jezike alat može da prepozna?

Model podržava 20 oznaka: arapski, bugarski, kineski, holandski, engleski, francuski, nemački, grčki, hindi, italijanski, japanski, poljski, portugalski, ruski, španski, svahili, tajlandski, turski, urdu i vijetnamski. Jezike izvan tog zatvorenog skupa ne prepoznaje pouzdano.

Zašto prvo preuzimanje ima oko 296 MB?

Alat koristi višejezički neuronski model XLM-R, a ne malu tabelu učestalosti znakova. Kvantizovani ONNX parametri zauzimaju oko 279 MB, a tokenizator oko 17 MB. Pregledač obično čuva oba u kešu, ali njegovo brisanje, privatno pregledanje ili brisanje podataka sajta mogu zahtevati novo preuzimanje.

Radi li prepoznavanje jezika bez WebGPU-a?

Da. Proces daje prednost WebGPU-u kada ga pregledač podržava. Ako WebGPU nije dostupan ili model ne može da se pokrene, alat pokušava ponovo uz WebAssembly na CPU-u. Obrada na procesoru i dalje zadržava tekst na vašem uređaju, ali učitavanje i prepoznavanje mogu trajati duže na telefonima i starijim računarima.

Šta znače ocene pouzdanosti?

Ocene rangiraju 20 mogućih oznaka modela za taj uzorak. Pomažu pri poređenju kandidata, ali nisu garancija, nezavisna verovatnoća tačnosti niti dokaz da je stvarni jezik podržan. Ako su vodeće ocene bliske, dodajte još prirodnog teksta.

Može li da prepozna mešani ili transliterisani tekst?

Alat vraća jedan vodeći rezultat i druge mogućnosti, a ne jezičku oznaku za svaku rečenicu ili reč. Mešani tekst može dati bliske ocene. Neformalna transliteracija, imena, emodžiji, URL adrese i izvorni kod takođe uklanjaju mnoge tragove pisma i pravopisa, pa je za takve unose potrebna pažljiva ljudska procena.