CanDoYa
SL

Analiza sentimenta - brezplačno orodje v brskalniku

Omejeni jeziki

Vse poteka v vašem brskalniku - brez nalaganja, brez registracije.

Prilepite povratno informacijo, oceno ali objavo, da ocenite njen ton.

Vaše besedilo obdeluje delavec v brskalniku in se nikoli ne naloži. Ob prvem zagonu se prenese javni AI model.

Tri oznake za celotni sentiment

Negativno pomeni neugoden ton, nevtralno pomeni brez jasnega pozitivnega ali negativnega nagiba, pozitivno pomeni ugoden ton.

Dodatno prilagojeno za arabščino, angleščino, francoščino, nemščino, hindijščino, italijanščino, portugalščino in španščino.

Model je zgrajen iz objav na družbenih omrežjih. Sarkazem, mešana čustva, strokovni jezik in besedila zunaj učnih jezikov so lahko napačno označeni.

Delite to orodje

Analiza sentimenta - kaj je to?

Analiza sentimenta razvrsti celoten ton besedila kot negativen, nevtralen ali pozitiven. To orodje v vašem brskalniku zažene večjezični model XLM-T in prikaže rezultat za vsako oznako. Besedilo ostane v vaši napravi, ob prvi analizi pa se iz javnih virov prenese model.

Kako uporabljati

  1. 1Prilepite uporaben odlomek. Vnesite mnenje, komentar, sporočilo ali objavo z družbenih omrežij. Popoln stavek modelu da več konteksta kot ena sama beseda.
  2. 2Zaženite lokalni model. Kliknite Analiziraj sentiment. Počakajte, da se ob prvem zagonu prenese model; dokler ostane predpomnilnik brskalnika na voljo, ga lahko pozneje znova uporabite.
  3. 3Preberite vse tri rezultate. Najvišjo oznako uporabite kot okvirni signal in primerjajte njeno vrednost z ostalima. Kadar so rezultati blizu skupaj, naj zadnjo presojo vedno poda človek.

Komu je namenjeno

Ta analizator sentimenta uporablja model Cardiff NLP XLM-T, sistem XLM-R, ki je bil predhodno naučen na približno 198 milijonih večjezičnih tvitov in nato za sentiment dodatno prilagojen za arabščino, angleščino, francoščino, nemščino, hindijščino, italijanščino, portugalščino in španščino. Oznake pomenijo neugoden splošen ton, brez jasnega pozitivnega ali negativnega nagiba ter ugoden splošen ton. Ne zaznavajo konkretnih čustev, resničnosti trditev, nujnosti ali namena avtorja.

Ker slovenščina ni med osmimi jeziki sentimentnega prilagajanja, so rezultati v slovenščini in drugih jezikih zunaj tega nabora približek, četudi večjezični osnovni model vrne oznako.

Prva analiza prenese skrčene ONNX uteži modela in datoteke za tokenizacijo, skupaj približno 297 MB. Inference poteka v delavcu brskalnika, zato uporabniški vmesnik ostane odziven. Prednost ima WebGPU, kadar ga brskalnik in grafična strojna oprema podpirata; počasnejša povratna možnost je CPU z WebAssembly. Brskalnik te datoteke običajno predpomni, vendar zasebno brskanje, čiščenje shrambe ali pomanjkanje prostora lahko sproži ponoven prenos. Največ prvih 1.000 znakov Unicode iz besedila se uporabi za analizo, dodatno pa lahko vhod skrajša tudi tokenizator.

Orodje uporablja Transformers.js za dejansko inferenco modela v brskalniku in ne zgolj seznamov ključnih besed. Vsi trije rezultati so relativne ocene za oznake negativno, nevtralno in pozitivno. So uporabni za primerjavo oznak med seboj, niso pa zagotovljene ali kalibrirane verjetnosti pravilnosti. Sarkazem, zanikanje, narekovanje tujih izjav, mešani ton, strokovni žargon, besedila zunaj domene družbenih omrežij ali v nepodprtih jezikih lahko povzročijo napačne oznake.

Pogosta vprašanja

Ali se moje besedilo naloži na strežnik?

Ne. Vaše besedilo se pošlje delavcu znotraj brskalnika in model teče v vaši napravi. Delavec iz zunanjih gostiteljev prenese javni runtime Transformers.js in datoteke modela, vendar ti zahtevki ne vsebujejo vnešenega besedila. CanDoYa primerkov besedila ne prejme in jih ne shranjuje.

Ali je to orodje za analizo sentimenta brezplačno?

Da. Za uporabo niso potrebni račun, plačilo, API ključ ali dnevna kvota analiz. Obremenitev prevzame vaša naprava. Praktični stroški so prvi prenos modela, lokalna shramba brskalnika, pomnilnik in procesorski čas. Ponudnik omrežja vam lahko kljub temu zaračuna prenos podatkov za model.

Koliko besedila lahko analiziram?

Prilepite lahko običajen odlomek, vendar orodje za analizo uporabi največ prvih 1.000 znakov Unicode, da ostane delovanje v brskalniku predvidljivo. Tokenizator modela dodatno odreže besedilo na svoje vhodno okno. Za daljše dokumente je bolje ločeno analizirati smiselne dele kot pa en sam skupni rezultat razumeti kot povzetek celotnega besedila.

Katerim jezikom je model sentimenta prilagojen?

Dodatno prilagajanje za sentiment pokriva arabščino, angleščino, francoščino, nemščino, hindijščino, italijanščino, portugalščino in španščino. Večjezični osnovni model lahko vrne oznake tudi za druge jezike, vendar za te ni enake nalogi prilagojene učne podlage. Zato so rezultati v slovenščini in drugih jezikih na tej strani označeni kot približni.

Kaj pomenijo negativno, nevtralno in pozitivno?

Negativno pomeni, da je model zaznal neugoden splošen ton. Nevtralno pomeni, da ni zaznal jasnega pozitivnega ali negativnega nagiba. Pozitivno pomeni, da je zaznal ugoden splošen ton. Te oznake opisujejo celoten oddani odlomek, niso kategorije čustev in ne dokazujejo, kaj avtor misli ali namerava.

Kaj pomenijo rezultati modela?

Tri vrednosti razvrstijo oznake negativno, nevtralno in pozitivno za ta vnos in skupaj običajno dajo približno 100 odstotkov. Uporabne so za primerjavo oznak med seboj, niso pa zagotovljene ali kalibrirane verjetnosti pravilnosti. Tudi visoka vrednost je lahko napačna, posebej kadar besedilo odstopa od učne domene modela.

Zakaj je prvi prenos velik približno 297 MB?

Orodje uporablja skrčene XLM-R ONNX uteži, velike približno 279 MB, in podatke tokenizatorja, velike približno 17 MB. To je precej več kot seznam ključnih besed, vendar model zajema kontekstualne jezikovne vzorce in ne zgolj šteje pozitivne in negativne besede. Brskalnik datoteke običajno shrani po prvem zagonu, vendar to predpomnjenje ni vedno zagotovljeno.

Ali analizator deluje brez WebGPU?

Da. Delavec najprej poskusi uporabiti WebGPU, kadar ga brskalnik in grafična kartica podpirata. Če ta pot ni na voljo ali se ne zažene, orodje analizo ponovi na povratni možnosti CPU z WebAssembly. Analiza na CPU uporablja isti model in ohrani besedilo lokalno, vendar lahko nalaganje in inferenca trajata dlje.