CanDoYa
FI

Sentimenttianalyysi ilmaiseksi selaimessa

Rajatut kielet

Toimii kokonaan selaimessasi - ei lähetyksiä, ei rekisteröitymistä.

Liitä pala palautetta, arvostelu tai some-julkaisu ja arvioi sen sävy.

Tekstisi käsitellään selaimen workerissa eikä sitä lähetetä palvelimelle. Ensimmäinen ajo lataa julkisen AI-mallin.

Kolme yleistä sentimenttiluokkaa

Negatiivinen tarkoittaa kielteistä sävyä, neutraali ettei selvää myönteistä tai kielteistä painotusta ole, ja positiivinen myönteistä sävyä.

Hienosäädetty arabiaksi, englanniksi, ranskaksi, saksaksi, hindiksi, italiaksi, portugaliksi ja espanjaksi.

Perustuu sosiaalisen median julkaisuihin. Sarkasmi, ristiriitaiset tunteet, erikoiskieli ja sen kielinen teksti, jota ei ole harjoitettu, voivat johtaa virheluokituksiin.

Jaa tämä työkalu

Sentimenttianalyysi - mikä se on?

Sentimenttianalyysi luokittelee tekstin yleisen asenteen negatiiviseksi, neutraaliksi tai positiiviseksi. Tämä työkalu ajaa monikielistä XLM-T-mallia suoraan selaimessasi ja näyttää pistemäärän jokaiselle luokalle. Tekstisi pysyy laitteellasi, vaikka julkinen malli ladataan ensimmäisellä analyysikerralla.

Näin se toimii

  1. 1Liitä edustava näyte. Syötä arvostelu, kommentti, viesti tai some-julkaisu. Täydellinen virke antaa mallille enemmän kontekstia kuin yksittäinen sana.
  2. 2Aja paikallinen malli. Valitse Analysoi sentimentti. Odota, että ensimmäinen mallin lataus valmistuu; myöhemmät käynnit voivat hyödyntää samaa mallia niin kauan kuin selaimen välimuisti on käytettävissä.
  3. 3Tarkastele kaikkia kolmea pistettä. Käytä parasta luokkaa karkeana signaalina ja vertaa sen pistettä muihin. Lähekkäin olevat pisteet tarkoittavat, että ihminen tarvitsee tekstin vielä itse luettavakseen.

Kenelle

Tämä sentimenttianalysaattori käyttää Cardiff NLP:n XLM-T -mallia, XLM-R -järjestelmää, joka on esikoulutettu noin 198 miljoonalla monikielisellä tweetillä ja hienosäädetty sentimenttitehtävään arabiaksi, englanniksi, ranskaksi, saksaksi, hindiksi, italiaksi, portugaliksi ja espanjaksi. Luokat kuvaavat kielteistä kokonais­sävyä, ei-selvästi myönteiseen tai kielteiseen suuntaan kallistumatonta sävyä sekä myönteistä kokonais­sävyä. Ne eivät tunnista yksittäisiä tunteita, totuudenmukaisuutta, kiireellisyyttä tai kirjoittajan tarkoitusperiä.

Suomi ei kuulu mallin kahdeksaan sentimentille hienosäädettyyn kieleen. Monikielinen pohjamalli voi silti palauttaa luokan suomenkieliselle tekstille, mutta näitä tuloksia kannattaa pitää likimääräisinä, ei kieleen erikseen validoituina.

Ensimmäinen analyysi lataa kvantisoidut XLM-R ONNX-mallipainot ja tokenisoijan tiedostot, yhteensä noin 297 MB. Selainajuri käyttää työtekijää, jotta laskenta ei kuormita käyttöliittymän pääsäiettä. WebGPU on ensisijainen tausta-ajo, jos selain ja näytönohjain sitä tukevat; WebAssembly-CPU on hitaampi varavaihtoehto. Selaimet yleensä välimuistittavat tiedostot, mutta yksityinen selaus, välimuistin tyhjennys tai levytilan puute voi pakottaa uuteen lataukseen.

Työkalu analysoi enintään ensimmäiset 1 000 Unicode-merkkiä. Mallin tokenisoija myös katkaisee syötteen oman ikkuna­kokonsa mukaan. Sarjallisuus, sarkasmi, kielteinen muoto, lainaukset, ristiriitaiset arviot, erikoissanasto, tukemattomat kielet ja tekstin poikkeaminen mallin sosiaalisen median harjoitusaineistosta voivat kaikki johtaa virheluokituksiin. Kolme pistettä vertailevat vain negatiivista, neutraalia ja positiivista luokkaa keskenään, eivätkä ole taattuja tai kalibroituja todennäköisyyksiä. Älä koskaan käytä yhtä sentimenttipistettä ainoana perusteena työhön liittyville, terveyteen, turvallisuuteen, moderointiin tai muihin korkean vaikutuksen päätöksiin.

Usein kysyttyä

Lähetetäänkö tekstini palvelimelle?

Ei. Teksti välitetään selaimen sisäiselle workerille, ja malli ajetaan omalla laitteellasi. Worker lataa julkisen Transformers.js -ajonaikaisen ympäristön ja mallin tiedostot ulkoisista lähteistä, mutta näiden pyyntöjen mukana ei kulje liittämääsi tekstiä. CanDoYa ei vastaanota tai tallenna näytettä.

Onko tämä sentimenttianalyysityökalu ilmainen?

Kyllä. Et tarvitse tiliä, maksua, API-avainta tai analyysikiintiötä. Laskenta tehdään omalla laitteellasi. Käytännön kustannuksia ovat ensimmäinen mallin lataus, selaimen paikallinen tallennustila, muistin käyttö ja prosessointiaika. Verkkoyhteyden tarjoajasi voi silti veloittaa mallin lataukseen käytetystä datasta.

Kuinka paljon tekstiä voin analysoida?

Voit liittää tavallisen tekstikatkelman, mutta työkalu analysoi enintään ensimmäiset 1 000 Unicode-merkkiä, jotta selaininfrenssi pysyy ennakoitavana. Mallin tokenisoija myös lyhentää tekstiä oman syöteikkunansa mukaan. Pitkiä asiakirjoja kannattaa analysoida johdonmukaisina osina sen sijaan, että yrittäisit tulkita yhtä yleisluonteen luokkaa koko dokumentin yhteenvedoksi.

Mitä kieliä sentimenttimalli tukee?

Sentimenttitehtävään hienosäätö on tehty arabiaksi, englanniksi, ranskaksi, saksaksi, hindiksi, italiaksi, portugaliksi ja espanjaksi. Monikielinen pohjamalli voi palauttaa luokkia myös muille kielille, mutta niistä puuttuu sama tehtäväkohtainen opetusnäyttö. Tämän vuoksi muut CanDoYa-kieliversiot, mukaan lukien suomi, merkitään likimääräisiksi.

Mitä negatiivinen, neutraali ja positiivinen tarkoittavat?

Negatiivinen tarkoittaa, että malli tulkitsi tekstin yleissävyltään kielteiseksi. Neutraali tarkoittaa, että selkeää myönteistä tai kielteistä painotusta ei löytynyt. Positiivinen tarkoittaa, että tekstin kokonais­sävy vaikuttaa myönteiseltä. Luokat kuvaavat koko annettua tekstikatkelmaa; ne eivät ole tunne­luokkia eivätkä todista, mitä kirjoittaja todella ajattelee tai aikoo.

Mitä mallin pisteet tarkoittavat?

Kolme pistettä asettavat negatiivisen, neutraalin ja positiivisen järjestykseen tätä syötettä varten ja summautuvat yleensä noin sataan prosenttiin. Ne auttavat vertailemaan mallin omia luokkia keskenään, mutta eivät ole taattuja oikeassa olemisen todennäköisyyksiä. Korkea pistemäärä voi silti olla väärä, etenkin jos teksti poikkeaa mallin harjoitusdomenista.

Miksi ensimmäinen lataus on noin 297 MB?

Työkalu käyttää noin 279 MB:n kokoisia kvantisoituja XLM-R ONNX-painoja ja noin 17 MB tokenisoija-aineistoa. Se on paljon suurempi kuin yksinkertainen avainsanalista, mutta mahdollistaa kielellisen kontekstin mallintamisen pelkän myönteisten ja kielteisten sanojen laskemisen sijaan. Selain yleensä välimuistittaa nämä tiedostot ensimmäisen ajon jälkeen, mutta välimuistia ei voida taata.

Toimiiko analysoija ilman WebGPU:ta?

Kyllä. Worker yrittää ensin käyttää WebGPU:ta, jos selain ja näytönohjain sitä tukevat. Jos tämä ei ole käytettävissä tai käynnistys epäonnistuu, työkalu siirtyy WebAssembly-CPU -taustaan. CPU-analyysi käyttää samaa mallia ja pitää tekstin paikallisena, mutta lataus ja inferenssi voivat kestää pidempään.