CanDoYa
SL

AI za prepoznavanje jezika

Omejeni jeziki

Vse poteka v vašem brskalniku - brez nalaganja, brez registracije.

Prilepite stavek ali odstavek, da prepoznate njegov jezik.

Besedilo se obdela v ločenem procesu brskalnika in se nikoli ne pošlje drugam. Prenese se samo javni model AI.

20 podprtih jezikov

Arabščina, bolgarščina, kitajščina, nizozemščina, angleščina, francoščina, nemščina, grščina, hindijščina, italijanščina, japonščina, poljščina, portugalščina, ruščina, španščina, svahili, tajščina, turščina, urdujščina in vietnamščina.

Besedilo v drugem jeziku je lahko napačno označeno kot najbližja podprta možnost.

Delite to orodje

Kako deluje prepoznavanje jezika?

Prepoznavanje jezika določi najverjetnejši jezik prilepljenega besedila. Orodje primerja vzorec z 20 jeziki in prikaže tri najvišje ocene modela. AI deluje lokalno v ločenem procesu brskalnika, zato se besedilo ne pošlje na strežnik, čeprav je treba model ob prvi uporabi prenesti.

Kako uporabljati

  1. 1Prilepite uporaben vzorec. Vnesite cel stavek ali odstavek v enem od 20 podprtih jezikov. Daljše, naravno besedilo je običajno lažje razlikovati kot ime ali posamezno besedo.
  2. 2Zaženite prepoznavanje v napravi. Kliknite Prepoznaj jezik. Ob prvem zagonu počakajte, da se model prenese. Ob naslednjih obiskih lahko orodje uporabi predpomnilnik brskalnika, če je še na voljo.
  3. 3Preglejte razvrščene zadetke. Preverite prvi jezik, kodo ISO, oceno in druge možnosti. Bližnje ocene, kratke vzorce in nepodprte jezike obravnavajte kot nezanesljive.

Komu je namenjeno

Orodje v vaši napravi zažene klasifikacijski model XLM-R, sklepanje pa opravi v ločenem procesu, da stran ostane odzivna. Prednost ima pospeševanje WebGPU, po potrebi pa poskusi znova s procesorskim zaledjem WebAssembly. Ob prvem zagonu prenese približno 296 MB podatkov modela in razčlenjevalnika z okolja Hugging Face. Brskalnik jih običajno shrani v predpomnilnik, vendar jih lahko odstrani, ko počistite shrambo ali zmanjka prostora.

Model primerja arabščino, bolgarščino, kitajščino, nizozemščino, angleščino, francoščino, nemščino, grščino, hindijščino, italijanščino, japonščino, poljščino, portugalščino, ruščino, španščino, svahili, tajščino, turščino, urdujščino in vietnamščino. Besedilo v drugem jeziku bo uvrščeno pod eno od teh oznak, zato pred uporabo rezultata preverite seznam podprtih jezikov.

Pogosta vprašanja

Ali se moje besedilo pošlje na strežnik?

Ne. Besedilo se posreduje ločenemu procesu v brskalniku, obdelava pa poteka v vaši napravi. Ta proces z zunanjih gostiteljev prenese javne datoteke modela in izvajalno okolje Transformers.js, vendar s temi zahtevami ne pošlje prilepljenega besedila. CanDoYa vzorca ne prejme in ne shrani.

Ali je prepoznavanje jezika brezplačno?

Da. Ne potrebujete računa, plačila, dobroimetja ali ključa API. Sklepanje opravi vaša naprava. Praktični stroški so prvi prenos modela, lokalna shramba, pomnilnik in čas obdelave. Pri internetni povezavi z obračunom po porabi je lahko prenos datotek modela plačljiv.

Koliko besedila lahko analiziram?

Prilepite lahko običajno besedilo poljubne dolžine, vendar orodje analizira največ prvih 400 znakov, da ostane v vhodnem oknu modela in je sklepanje v brskalniku predvidljivo. Potrebni so najmanj štirje črkovni ali številski znaki. Za uporaben rezultat vnesite vsaj en naraven stavek, odstavek pa modelu ponudi več razlikovalnih vzorcev.

Katere jezike lahko orodje prepozna?

Model podpira 20 oznak: arabščino, bolgarščino, kitajščino, nizozemščino, angleščino, francoščino, nemščino, grščino, hindijščino, italijanščino, japonščino, poljščino, portugalščino, ruščino, španščino, svahili, tajščino, turščino, urdujščino in vietnamščino. Jezikov zunaj te zaprte množice ne prepozna zanesljivo.

Zakaj prvi prenos obsega približno 296 MB?

Orodje uporablja večjezični nevronski model XLM-R in ne majhne tabele pogostosti znakov. Kvantizirane uteži ONNX obsegajo približno 279 MB, razčlenjevalnik pa približno 17 MB. Brskalnik oboje običajno shrani v predpomnilnik, toda brisanje podatkov spletnega mesta, zasebno brskanje ali odstranjevanje predpomnilnika lahko zahteva nov prenos.

Ali prepoznavanje jezika deluje brez WebGPU?

Da. Proces uporabi WebGPU, kadar ga brskalnik ponuja. Če WebGPU ni na voljo ali se model ne zažene, orodje poskusi znova z WebAssembly v procesorju. Procesorsko sklepanje še vedno zadrži besedilo v vaši napravi, vendar sta nalaganje in prepoznavanje na telefonih ter starejših računalnikih lahko počasnejša.

Kaj pomenijo ocene zaupanja?

Ocene razvrstijo 20 možnih oznak modela za ta vzorec. Uporabne so za primerjavo kandidatov, vendar niso jamstvo, neodvisna verjetnost pravilnosti ali dokaz, da je pravi jezik podprt. Če sta vodilni oceni blizu, dodajte več naravnega besedila.

Ali lahko prepozna mešano ali prečrkovano besedilo?

Orodje vrne en vodilni zadetek in druge možnosti, ne pa jezikovne oznake za vsak stavek ali besedo. Mešano besedilo lahko da bližnje ocene. Neformalno prečrkovanje, imena, čustveni simboli, naslovi URL in izvorna koda prav tako odstranijo veliko namigov iz pisave in črkovanja, zato je pri teh vnosih potreben previden človeški pregled.