| Naslov: | Strojno učenje in obdelava naravnega jezika za pripravo analize sentimenta na spletu |
|---|
| Avtorji: | ID Jerin, Matija (Avtor) ID Kljajić Borštnar, Mirjana (Mentor) Več o mentorju...  |
| Datoteke: | MAG_Jerin_Matija_2025.pdf (4,85 MB) MD5: 966733DD4F7499945AEA26F3CADA8F72
|
|---|
| Jezik: | Slovenski jezik |
|---|
| Vrsta gradiva: | Magistrsko delo/naloga |
|---|
| Tipologija: | 2.09 - Magistrsko delo |
|---|
| Organizacija: | FOV - Fakulteta za organizacijske vede
|
|---|
| Opis: | Magistrsko delo obravnava področje analize sentimenta z uporabo strojnega učenja in obdelave naravnega jezika. Namen dela je razviti model, ki bi bil sposoben analizirati sentiment besedil, pridobljenih s spletnih platform, zlasti z družbenega omrežja X (prej Twitter).
V delu smo uporabili različne metode strojnega učenja in obdelave naravnega jezika. Najprej smo podatke pridobili iz odprtih virov, jih očistili in normalizirali z metodami, kot sta lemmatizacija in tokenizacija. Pri obdelavi podatkov smo uporabili več tehnik, vključno z Bag of Words, s pozitivno/z negativno frekvenco in s TF-IDF, za kar smo uporabili Python knjižnice, kot sta NLTK in scikit-learn. Model smo učili z metodo logistične regresije, naivnega bayesa in z metodo podpornih vektorjev ter testirali njihovo natančnost s pomočjo ločenih testnih podatkov.
Rezultati kažejo, da je logistična regresija v kombinaciji z značilkami TF-IDF dosegla najvišjo natančnost pri predvidevanju sentimenta, in sicer 88,65 %, kar pomeni, da je model sposoben zanesljivo prepoznati sentiment besedil kot pozitiven ali negativen. Kljub uspehu modela obstaja potencial za nadaljnje izboljšave. Uporaba večjih in bolj raznovrstnih podatkovnih zbirk ter naprednejših tehnik globokega učenja, kot so nevronske mreže (LSTM ali BERT), bi lahko še povečala natančnost in zmogljivost modela.
Zaključki magistrskega dela potrjujejo, da je analiza sentimenta z uporabo strojnega učenja izvedljiva in uporabna v različnih okoljih. V prihodnje priporočamo implementacijo API-ja za omrežje X, kar bi omogočilo sprotno pridobivanje podatkov in avtomatizirano analizo sentimenta v realnem času. Prav tako bi lahko nadgradnja modela z globokim učenjem pripomogla k obvladovanju kompleksnejših jezikovnih struktur in kontekstov, kot sta sarkazem in večpomenskost. |
|---|
| Ključne besede: | analiza sentimenta, strojno učenje, obdelava naravnega jezika |
|---|
| Kraj izida: | Maribor |
|---|
| Leto izida: | 2025 |
|---|
| PID: | 20.500.12556/DKUM-91477  |
|---|
| COBISS.SI-ID: | 231923203  |
|---|
| Datum objave v DKUM: | 09.04.2025 |
|---|
| Število ogledov: | 198 |
|---|
| Število prenosov: | 35 |
|---|
| Metapodatki: |  |
|---|
| Področja: | FOV
|
|---|
|
:
|
Kopiraj citat |
|---|
| | | | Skupna ocena: | (0 glasov) |
|---|
| Vaša ocena: | Ocenjevanje je dovoljeno samo prijavljenim uporabnikom. |
|---|
| Objavi na: |  |
|---|
Postavite miškin kazalec na naslov za izpis povzetka. Klik na naslov izpiše
podrobnosti ali sproži prenos. |