CanDoYa
HR

AI prepoznavanje jezika

Ograničeni jezici

Radi u cijelosti u pregledniku - bez slanja podataka i bez registracije.

Zalijepite rečenicu ili odlomak da biste prepoznali jezik.

Tekst se obrađuje u zasebnom procesu preglednika i nikada se ne šalje. Preuzima se samo javni AI model.

20 podržanih jezika

Arapski, bugarski, kineski, nizozemski, engleski, francuski, njemački, grčki, hindski, talijanski, japanski, poljski, portugalski, ruski, španjolski, svahili, tajlandski, turski, urdski i vijetnamski.

Tekst na drugom jeziku može biti pogrešno označen kao najsličnija podržana mogućnost.

Podijelite ovaj alat

Kako radi prepoznavanje jezika?

Prepoznavanje jezika određuje najvjerojatniji jezik zalijepljenog teksta. Ovaj alat uspoređuje uzorak s 20 jezika i prikazuje tri najviša rezultata modela. AI radi lokalno u zasebnom procesu preglednika, pa se tekst ne šalje na poslužitelj, iako se model mora preuzeti pri prvoj upotrebi.

Kako se koristi

  1. 1Zalijepite koristan uzorak. Unesite cijelu rečenicu ili odlomak na jednom od 20 podržanih jezika. Dulji, prirodan tekst obično je lakše razlikovati od imena ili jedne riječi.
  2. 2Pokrenite prepoznavanje na uređaju. Kliknite Prepoznaj jezik. Pri prvom pokretanju pričekajte preuzimanje modela. Pri kasnijim posjetima alat može ponovno upotrijebiti predmemoriju preglednika ako je još dostupna.
  3. 3Pregledajte rangirane rezultate. Provjerite vodeći jezik, ISO oznaku, rezultat i druge mogućnosti. Bliske rezultate, kratke uzorke i nepodržane jezike smatrajte nepouzdanima.

Za koga je

Alat pokreće klasifikacijski model XLM-R na vašem uređaju, a zaključivanje obavlja u zasebnom procesu kako bi stranica ostala responzivna. Prednost daje ubrzanju WebGPU, a po potrebi pokušava ponovno putem procesorske pozadine WebAssembly. Pri prvom pokretanju preuzima se oko 296 MB podataka modela i tokenizatora s Hugging Facea. Preglednik ih obično sprema u predmemoriju, ali ih može ukloniti kada izbrišete pohranu ili ponestane prostora.

Model uspoređuje arapski, bugarski, kineski, nizozemski, engleski, francuski, njemački, grčki, hindski, talijanski, japanski, poljski, portugalski, ruski, španjolski, svahili, tajlandski, turski, urdski i vijetnamski. Tekst na drugom jeziku bit će svrstan pod jednu od tih oznaka, zato provjerite popis podržanih jezika prije nego što se oslonite na rezultat.

Česta pitanja

Šalje li se moj tekst na poslužitelj?

Ne. Tekst se prosljeđuje zasebnom procesu unutar preglednika, a obrada se odvija na vašem uređaju. Taj proces preuzima javne datoteke modela i okruženje Transformers.js s vanjskih poslužitelja, ali uz te zahtjeve ne šalje zalijepljeni tekst. CanDoYa ne prima niti pohranjuje uzorak.

Je li prepoznavanje jezika besplatno?

Da. Nisu potrebni račun, plaćanje, kreditno ograničenje ni API ključ. Obradu izvršava vaš uređaj. Stvarni troškovi su prvo preuzimanje modela, lokalni prostor, memorija i vrijeme obrade. Ako se internetska veza naplaćuje prema prometu, preuzimanje datoteka modela može se dodatno naplatiti.

Koliko teksta mogu analizirati?

Možete zalijepiti uobičajen tekst bilo koje duljine, ali alat analizira najviše prvih 400 znakova kako bi ostao unutar ulaznog prozora modela i zadržao predvidljivu obradu u pregledniku. Najmanje su potrebna četiri slova ili brojke. Za koristan rezultat unesite barem jednu prirodnu rečenicu, a odlomak modelu daje više prepoznatljivih uzoraka.

Koje jezike alat može prepoznati?

Model podržava 20 oznaka: arapski, bugarski, kineski, nizozemski, engleski, francuski, njemački, grčki, hindski, talijanski, japanski, poljski, portugalski, ruski, španjolski, svahili, tajlandski, turski, urdski i vijetnamski. Jezike izvan tog zatvorenog skupa ne prepoznaje pouzdano.

Zašto prvo preuzimanje ima oko 296 MB?

Alat koristi višejezični neuronski model XLM-R, a ne malu tablicu učestalosti znakova. Kvantizirani ONNX utezi zauzimaju oko 279 MB, a tokenizer oko 17 MB. Preglednik obično sprema oboje u predmemoriju, ali njezino pražnjenje, privatno pregledavanje ili brisanje podataka web-mjesta mogu zahtijevati novo preuzimanje.

Radi li prepoznavanje jezika bez WebGPU-a?

Da. Proces daje prednost WebGPU-u kada ga preglednik podržava. Ako WebGPU nije dostupan ili se model ne uspije pokrenuti, alat pokušava ponovno uz WebAssembly na CPU-u. Obrada na procesoru i dalje zadržava tekst na vašem uređaju, ali učitavanje i prepoznavanje mogu trajati dulje na mobitelima i starijim računalima.

Što znače rezultati pouzdanosti?

Rezultati rangiraju 20 mogućih oznaka modela za taj uzorak. Pomažu pri usporedbi kandidata, ali nisu jamstvo, neovisna vjerojatnost točnosti niti dokaz da je stvarni jezik podržan. Ako su vodeći rezultati bliski, dodajte još prirodnog teksta.

Može li prepoznati miješani ili transliterirani tekst?

Alat vraća jedan vodeći rezultat i druge mogućnosti, a ne jezičnu oznaku za svaku rečenicu ili riječ. Miješani tekst može dati bliske rezultate. Neslužbena transliteracija, imena, emojiji, URL-ovi i izvorni kôd također uklanjaju brojne tragove pisma i pravopisa, pa je za takve unose potrebna oprezna ljudska procjena.