CanDoYa
LT

Sentimentų analizė - nemokamas naršyklinis įrankis

Ribotos kalbos

Veikia tik jūsų naršyklėje - nieko neįkeliama, registracija nereikalinga.

Įklijuokite atsiliepimą, apžvalgą ar socialinio tinklo įrašą, kad įvertintumėte jo nuostatą.

Jūsų tekstas apdorojamas naršyklės worker procese ir niekada neišsiunčiamas. Pirmą kartą paleidus atsisiunčiamas viešas AI modelis.

Trys bendros sentimentų etiketės

Neigiama reiškia nepalankią nuostatą, neutrali - aiškios teigiamos ar neigiamos krypties nebuvimą, o teigiama - palankią nuostatą.

Modelis sentimentui pritaikytas arabų, anglų, prancūzų, vokiečių, hindi, italų, portugalų ir ispanų kalboms.

Sukurtas iš socialinių įrašų. Sarkazmas, mišrios emocijos, specializuota kalba ir tekstas kalbomis, kurių modelis nemokėtas, gali būti neteisingai pažymėti.

Dalintis šiuo įrankiu

Sentimentų analizė - kas tai?

Sentimentų analizė nustato bendrą teksto nuostatą kaip neigiamą, neutralią arba teigiamą. Šis įrankis naršyklėje paleidžia daugiakalbį XLM-T modelį ir parodo kiekvienos etiketės balą. Jūsų tekstas lieka įrenginyje, nors pirmo paleidimo metu atsisiunčiami vieši modelio failai.

Kaip naudotis

  1. 1Įklijuokite prasmingą pavyzdį. Įveskite atsiliepimą, komentarą, žinutę ar socialinio tinklo įrašą. Pilnas sakinys suteikia modeliui daugiau konteksto nei vienas žodis.
  2. 2Paleiskite vietinį modelį. Spustelėkite „Analizuoti nuostatą“. Leiskite užbaigti pirmą modelio atsisiuntimą; kol naršyklės talpykla išlieka, vėlesni apsilankymai galės juo pasinaudoti iš naujo.
  3. 3Perskaitykite visus tris balus. Aukščiausią etiketę naudokite kaip bendrą signalą ir palyginkite jos balą su kitomis. Artimi balai reiškia, kad būtinas žmogaus vertinimas, o ne tvirta išvada.

Kam pravers

Ši sentimentų analizė naudoja Cardiff NLP XLM-T modelį - XLM-R sistemą, iš anksto apmokytą su maždaug 198 milijonais daugiakalbių įrašų tinkle „X“ (buvęs „Twitter“) ir sentimentui specialiai pritaikytą tik arabų, anglų, prancūzų, vokiečių, hindi, italų, portugalų ir ispanų kalboms. Išvesties etiketės reiškia nepalankią bendrą nuostatą, aiškios krypties neturinčią nuostatą ir palankią bendrą nuostatą. Jos nenustato konkrečių emocijų, tiesos, skubos ar autoriaus ketinimo. Lietuvių kalba nėra tarp aštuonių taikiniui pritaikytų kalbų, todėl rezultatai lietuviškiems tekstams yra apytikriai, nors daugiakalbis modelis vis tiek gali grąžinti etiketę.

Pirmą kartą paleidus analizę atsisiunčiami kvantuoti ONNX modelio svoriai ir žetonizatoriaus failai, iš viso apie 297 MB. Naršyklės worker procesas atlieka išvedimą atskirai nuo pagrindinės sąsajos. Kai tik įmanoma, pirmenybė teikiama WebGPU; WebAssembly CPU aplinka yra lėtesnė atsarginė parinktis. Paprastai naršyklė šiuos failus talpina atmintyje, bet privatumo režimas, talpyklos išvalymas ar mažai laisvos vietos diske gali reikšti, kad vėliau juos reikės atsisiųsti dar kartą.

DUK

Ar mano tekstas įkeliamas į serverį?

Ne. Jūsų tekstas siunčiamas į worker procesą naršyklėje, o modelis veikia jūsų įrenginyje. Worker atsisiunčia viešus Transformers.js vykdymo ir modelio failus iš išorinių serverių, bet tuose užklausose jūsų įklijuoto teksto nėra. CanDoYa negauna ir nesaugo pateikto pavyzdžio.

Ar ši sentimentų analizė yra nemokama?

Taip. Nereikia paskyros, mokėjimo, API rakto ar analizės limito. Visus skaičiavimus atlieka jūsų įrenginys. Praktinės sąnaudos yra pirmasis modelio atsisiuntimas, vietinė naršyklės saugykla, atmintis ir apdorojimo laikas. Jūsų tinklo tiekėjas vis tiek gali taikyti mokesčius už duomenis, sunaudotus modelio atsisiuntimui.

Kiek teksto galiu analizuoti?

Galite įklijuoti įprastą pastraipą, tačiau įrankis analizuoja daugiausia pirmuosius 1 000 Unicode simbolių, kad naršyklės išvedimas išliktų prognozuojamas. Modelio žetonizatorius taip pat nukerpa tekstą iki savo įvesties lango. Ilgiems dokumentams analizuokite atskiras rišlias dalis, o ne laikykite vieną bendrą etiketę viso dokumento santrauka.

Kurioms kalboms sentimentų modelis tinka geriausiai?

Sentimentui modelis buvo specialiai pritaikytas arabų, anglų, prancūzų, vokiečių, hindi, italų, portugalų ir ispanų kalboms. Daugiakalbis bazinis modelis gali grąžinti etiketes ir kitoms kalboms, tačiau tokiais atvejais nėra to paties užduočiai skirto mokymo pagrindo. Todėl šiame puslapyje lietuvių kalba ir kitos CanDoYa lokalės pažymimos kaip apytikrės.

Ką reiškia neigiama, neutrali ir teigiama?

Neigiama reiškia, kad modelis aptiko nepalankią bendrą nuostatą. Neutrali reiškia, kad neaptiko aiškios teigiamos ar neigiamos krypties. Teigiama reiškia, kad rado palankią bendrą nuostatą. Šios etiketės apibūdina visą pateiktą pavyzdį; tai nėra emocijų kategorijos ir jos neįrodo, ką autorius iš tiesų galvoja ar ketina.

Ką reiškia modelio balai?

Trys balai palygina neigiamą, neutralią ir teigiamą etiketes konkrečiam įvedimui ir paprastai sudaro apie 100 procentų. Jie naudingi lyginant modelio etiketes tarpusavyje, bet nėra garantuotos teisingumo tikimybės. Net ir aukštas balas gali būti klaidingas, ypač kai tekstas skiriasi nuo duomenų, kuriais modelis buvo mokytas.

Kodėl pirmas atsisiuntimas siekia apie 297 MB?

Įrankis naudoja apie 279 MB dydžio kvantuotus XLM-R ONNX svorius ir maždaug 17 MB žetonizatoriaus duomenų. Tai gerokai daugiau nei paprastas raktažodžių sąrašas, bet dėl to modelis gali fiksuoti kontekstinius kalbos raštus, o ne vien skaičiuoti tariamai teigiamus ir neigiamus žodžius. Paprastai naršyklė šiuos failus po pirmo paleidimo talpina atmintyje, tačiau to nėra garantijos.

Ar analizatorius veikia be WebGPU?

Taip. Worker pirmiausia bando naudoti WebGPU, jei jį palaiko naršyklė ir vaizdo plokštė. Jei ši galimybė nepasiekiama arba nepavyksta jos paleisti, įrankis pakartoja bandymą su WebAssembly CPU aplinka. CPU analizė naudoja tą patį modelį ir taip pat neišsiunčia teksto į išorę, tačiau įkėlimas ir išvedimas gali trukti ilgiau.