CanDoYa
SK

Analýza sentimentu online zadarmo

Obmedzené jazyky

Beží celý vo vašom prehliadači - bez nahrávania, bez registrácie.

Vložte spätnú väzbu, recenziu alebo príspevok zo sociálnych sietí a zistite jej tón.

Text sa spracúva v workeri prehliadača a nikdy sa nenahráva. Pri prvom spustení sa stiahne verejný AI model.

Tri celkové štítky sentimentu

Negatívny znamená nepriaznivý tón, neutrálny žiadny jasný pozitívny ani negatívny sklon a pozitívny priaznivý tón.

Doladený pre arabčinu, angličtinu, francúzštinu, nemčinu, hindčinu, taliančinu, portugalčinu a španielčinu.

Model je naučený zo sociálnych príspevkov. Sarkazmus, zmiešané pocity, odborný jazyk a text mimo trénovaných jazykov môže byť označený nesprávne.

Zdieľať tento nástroj

Čo je analýza sentimentu?

Analýza sentimentu triedi celkové vyznenie textu na negatívne, neutrálne alebo pozitívne. Tento nástroj spúšťa viacjazyčný model XLM-T cez Transformers.js priamo v prehliadači a zobrazí skóre pre každý štítok. Text zostáva vo vašom zariadení, pri prvom spustení sa však stiahne verejný model. Pre slovenčinu neprebehlo špeciálne doladenie na sentiment, takže výsledky sú len približné.

Ako na to

  1. 1Vložte zmysluplnú ukážku. Zadajte recenziu, komentár, správu alebo príspevok zo sociálnych sietí. Úplná veta dáva modelu viac kontextu než jedno slovo.
  2. 2Spustite lokálny model. Kliknite na možnosť Analýza sentimentu. Počkajte, kým sa pri prvom použití stiahne model - pri ďalších návštevách ho môže prehliadač znovu použiť, kým je cache dostupná.
  3. 3Prečítajte si všetky tri skóre. Vnímajte najvyšší štítok ako hrubý signál a porovnajte jeho skóre s ostatnými. Ak sú skóre podobné, je na mieste ľudská interpretácia, nie definitívny záver.

Pre koho je nástroj určený

Tento analyzátor sentimentu používa model Cardiff NLP XLM-T, teda XLM-R systém trénovaný na približne 198 miliónoch viacjazyčných tweetov a následne doladený na sentiment pre arabčinu, angličtinu, francúzštinu, nemčinu, hindčinu, taliančinu, portugalčinu a španielčinu. Výstupné štítky vyjadrujú nepriaznivý celkový tón, žiadne zreteľné pozitívne ani negatívne vyznenie a priaznivý celkový tón. Neidentifikujú konkrétne emócie, pravdivosť, naliehavosť ani úmysel autora. Pre slovenčinu a ďalšie nepodporované jazyky model síce vráti štítok, ale keďže neboli súčasťou sentimentového doladenia, ide len o orientačný signál.

Pri prvej analýze sa stiahnu kvantizované ONNX váhy modelu a súbory tokenizeru s celkovou veľkosťou asi 297 MB. Pracovný proces v prehliadači (browser worker) spúšťa inferenciu mimo hlavného UI vlákna. Ak je k dispozícii, uprednostní sa WebGPU, pomalšou záložnou možnosťou je CPU backend cez WebAssembly. Prehliadač sa tieto súbory zvyčajne pokúsi ponechať v cache, ale anonymné prehliadanie, čistenie úložiska alebo nedostatok miesta môžu viesť k opätovnému sťahovaniu.

Časté otázky

Nahráva sa môj text na server?

Nie. Text sa odosiela do workeru vo vašom prehliadači a model beží lokálne vo vašom zariadení. Worker si pritom sťahuje verejný runtime Transformers.js a súbory modelu z externých hostiteľov, ale tieto požiadavky neobsahujú vložený text. CanDoYa nedostáva ani neukladá vašu ukážku.

Je tento nástroj na analýzu sentimentu zadarmo?

Áno. Nepotrebujete účet, platbu, API kľúč ani kvótu na počet analýz. Výpočet vykonáva vaše zariadenie. Praktické náklady sú prvé stiahnutie modelu, miesto v lokálnom úložisku prehliadača, pamäť a čas spracovania. Váš operátor vám však môže účtovať prenesené dáta pri sťahovaní modelu.

Koľko textu môžem analyzovať?

Môžete vložiť bežný odsek, nástroj však analyzuje najviac prvých 1 000 znakov Unicode, aby bolo správanie v prehliadači predvídateľné. Tokenizer modelu navyše text skracuje na svoje vstupné okno. Pri dlhých dokumentoch analyzujte samostatné súvislé časti, namiesto jedného celkového štítku pre celý dokument.

Ktoré jazyky model sentimentu podporuje?

Doladenie na sentiment prebehlo pre arabčinu, angličtinu, francúzštinu, nemčinu, hindčinu, taliančinu, portugalčinu a španielčinu. Viacjazyčný základný model môže vracať štítky aj pre iné jazyky, ale pre tieto výstupy neexistuje rovnaký typ cieľového trénovania. Pre slovenčinu a ďalšie lokality CanDoYa sú preto výsledky označené ako približné.

Čo znamenajú negatívny, neutrálny a pozitívny?

Negatívny znamená, že model vyhodnotil celkový tón ako nepriaznivý. Neutrálny znamená, že nenašiel jasný pozitívny ani negatívny sklon. Pozitívny znamená, že celkový tón je priaznivý. Tieto štítky opisujú celý odoslaný úryvok; nie sú to kategórie emócií a nedokazujú, čo si autor myslí alebo čo má v úmysle.

Čo znamenajú skóre modelu?

Tri skóre porovnávajú negatívny, neutrálny a pozitívny štítok pre daný vstup a zvyčajne sa sčítajú približne na 100 percent. Sú užitočné na porovnanie toho, ktoré označenie model uprednostňuje, ale nie sú garantovanými pravdepodobnosťami správnosti. Aj vysoké skóre môže byť nesprávne, najmä ak text vybočuje z domény, na ktorej sa model učil.

Prečo má prvé stiahnutie približne 297 MB?

Nástroj používa kvantizované ONNX váhy modelu XLM-R s veľkosťou okolo 279 MB a dáta tokenizeru asi 17 MB. Je to výrazne viac než jednoduchý zoznam kľúčových slov, ale vďaka tomu dokáže model zachytiť kontextové jazykové vzorce namiesto obyčajného počítania pozitívnych a negatívnych slov. Prehliadač tieto súbory po prvom spustení zvyčajne kešuje, avšak cache nie je zaručená.

Funguje analyzátor aj bez WebGPU?

Áno. Worker sa najprv pokúsi použiť WebGPU, ak ho podporuje prehliadač a grafický adaptér. Ak táto cesta nie je dostupná alebo sa nepodarí spustiť, nástroj sa prepne na CPU backend cez WebAssembly. Analýza na CPU používa ten istý model a text zostáva lokálny, ale načítanie aj inferencia môžu trvať dlhšie.