<?xml version="1.0" encoding="utf-8"?>
<Gradivo ID="91477" NadgradivoID="0" NRID="25631810" OceID="0" DomainUrl="https://dk.um.si/" IzpisPolniUrl="https://dk.um.si/IzpisGradiva.php?lang=slv&amp;id=91477" StOgledov="200" StPrenosov="35" StOcen="0" VsotaOcen="0" DatumIzvoza="2026-10-01 15:26:42" OcenaSkupna="0" StPodgradiv="0" StudijskiProgramEvsID="" JeIndeksirano="0" JeVecAvtorjev="0" DovoliZahtevkeZaDostop="0">
  <PID Url="http://hdl.handle.net/20.500.12556/DKUM-91477">20.500.12556/DKUM-91477</PID>
  <Naslov>Strojno učenje in obdelava naravnega jezika za pripravo analize sentimenta na spletu</Naslov>
  <Podnaslov></Podnaslov>
  <TujJezik_Naslov>Machine learning and natural language processing for sentiment analysis on the internet</TujJezik_Naslov>
  <TujJezik_Podnaslov></TujJezik_Podnaslov>
  <Opis>Magistrsko delo obravnava področje analize sentimenta z uporabo strojnega učenja in obdelave naravnega jezika. Namen dela je razviti model, ki bi bil sposoben analizirati sentiment besedil, pridobljenih s spletnih platform, zlasti z družbenega omrežja X (prej Twitter). 
V delu smo uporabili različne metode strojnega učenja in obdelave naravnega jezika. Najprej smo podatke pridobili iz odprtih virov, jih očistili in normalizirali z metodami, kot sta lemmatizacija in tokenizacija. Pri obdelavi podatkov smo uporabili več tehnik, vključno z Bag of Words, s pozitivno/z negativno frekvenco in s TF-IDF, za kar smo uporabili Python knjižnice, kot sta NLTK in scikit-learn. Model smo učili z metodo logistične regresije, naivnega bayesa in z metodo podpornih vektorjev ter testirali njihovo natančnost s pomočjo ločenih testnih podatkov.
Rezultati kažejo, da je logistična regresija v kombinaciji z značilkami TF-IDF dosegla najvišjo natančnost pri predvidevanju sentimenta, in sicer 88,65 %, kar pomeni, da je model sposoben zanesljivo prepoznati sentiment besedil kot pozitiven ali negativen. Kljub uspehu modela obstaja potencial za nadaljnje izboljšave. Uporaba večjih in bolj raznovrstnih podatkovnih zbirk ter naprednejših tehnik globokega učenja, kot so nevronske mreže (LSTM ali BERT), bi lahko še povečala natančnost in zmogljivost modela.
Zaključki magistrskega dela potrjujejo, da je analiza sentimenta z uporabo strojnega učenja izvedljiva in uporabna v različnih okoljih. V prihodnje priporočamo implementacijo API-ja za omrežje X, kar bi omogočilo sprotno pridobivanje podatkov in avtomatizirano analizo sentimenta v realnem času. Prav tako bi lahko nadgradnja modela z globokim učenjem pripomogla k obvladovanju kompleksnejših jezikovnih struktur in kontekstov, kot sta sarkazem in večpomenskost.</Opis>
  <TujJezik_Opis>The master&#039;s thesis addresses the field of sentiment analysis using machine learning and natural language processing. The aim of the thesis is to develop a model capable of analyzing the sentiment of texts obtained from online platforms, particularly from the social network X (formerly Twitter).
In the thesis, various machine learning and natural language processing methods were applied. First, data were obtained from open sources, cleaned, and normalized using methods such as lemmatization and tokenization. Several techniques were employed for data processing, including Bag of Words, positive/negative frequency, and TF-IDF, using Python libraries such as NLTK and scikit-learn. The model was trained using logistic regression, naive bayes and support vector machine and then we tested their accuracy with separate test data.
The results show that logistic regression in combination with the TF-IDF method achieved the highest accuracy in sentiment prediction, reaching 88.65%, meaning the model is capable of reliably identifying the sentiment of texts as positive or negative. Despite the model&#039;s success, there is potential for further improvements. Using larger and more diverse datasets, along with advanced deep learning techniques such as neural networks (LSTM or BERT), could further enhance the model&#039;s accuracy and performance.
The conclusions of the master&#039;s thesis confirm that sentiment analysis using machine learning is feasible and applicable in various environments. In the future, the implementation of the X network API is recommended, which would allow real-time data acquisition and automated sentiment analysis. Additionally, upgrading the model with deep learning could help manage more complex linguistic structures and contexts, such as sarcasm and ambiguity.</TujJezik_Opis>
  <KljucneBesede>
    <Beseda>analiza sentimenta</Beseda>
    <Beseda>strojno učenje</Beseda>
    <Beseda>obdelava naravnega jezika</Beseda>
  </KljucneBesede>
  <TujJezik_KljucneBesede>
    <Beseda>Sentiment analysis</Beseda>
    <Beseda>Machine learning</Beseda>
    <Beseda>Natural language processing</Beseda>
  </TujJezik_KljucneBesede>
  <Potrjeno>true</Potrjeno>
  <JeZaklenjeno>true</JeZaklenjeno>
  <JeRecenzirano>false</JeRecenzirano>
  <Zaloznik></Zaloznik>
  <Izvor></Izvor>
  <Jezik ID="1060" ISO639-3="slv">Slovenski jezik</Jezik>
  <TujJezik ID="1033" ISO639-3="eng">Angleški jezik</TujJezik>
  <Povezave></Povezave>
  <Pokrivanje></Pokrivanje>
  <CasovnoPokritje></CasovnoPokritje>
  <AvtorskePravice></AvtorskePravice>
  <VrstaGradiva ID="mb22" DRIVER="info:eu-repo/semantics/masterThesis">Magistrsko delo/naloga</VrstaGradiva>
  <DatumVstavljanja>2025-01-06 22:35:42</DatumVstavljanja>
  <DatumObjave>2025-04-09 09:57:36</DatumObjave>
  <DatumSpremembe>2025-04-10 03:08:34</DatumSpremembe>
  <DatumTrajnegaHranjenja>0000-00-00 00:00:00</DatumTrajnegaHranjenja>
  <LetoIzida>2025</LetoIzida>
  <LetoIzidaDo>0</LetoIzidaDo>
  <KrajIzida>Maribor</KrajIzida>
  <LetoIzvedbe>0</LetoIzvedbe>
  <KrajIzvedbe></KrajIzvedbe>
  <Opomba></Opomba>
  <StStrani></StStrani>
  <StevilcenjeNivo1></StevilcenjeNivo1>
  <StevilcenjeNivo2></StevilcenjeNivo2>
  <Kronologija></Kronologija>
  <Patent_Stevilka></Patent_Stevilka>
  <Patent_DatumVeljavnosti>0000-00-00</Patent_DatumVeljavnosti>
  <VerzijaDokumenta>NiDoloceno</VerzijaDokumenta>
  <StatusObjaveDrugje>NiDoloceno</StatusObjaveDrugje>
  <VrstaStroskaObjave>NiDoloceno</VrstaStroskaObjave>
  <DatumPoslanoVRecenzijo>0000-00-00</DatumPoslanoVRecenzijo>
  <DatumSprejetjaClanka>0000-00-00</DatumSprejetjaClanka>
  <DatumObjaveClanka>0000-00-00</DatumObjaveClanka>
  <Licence>
    <Licenca ID="1" Kratica="CC BY-NC-ND 4.0" Naziv="Creative Commons Priznanje avtorstva-Nekomercialno-Brez predelav 4.0 Mednarodna" URL="http://creativecommons.org/licenses/by-nc-nd/4.0/deed.sl" Logo="by-nc-nd.eu.png" LogoPolniUrl="https://dk.um.si/teme/dkumDev2/img/licence/by-nc-nd.eu.png" DatumZacetkaLicenciranja="2025-01-06" VezanoNa="" VezanoNaAng="" Besedilo="" BesediloAng=""></Licenca>
  </Licence>
  <EmbargoDo></EmbargoDo>
  <VrstaEmbarga ID="1" Naziv="Takojšnja javna objava" OpenAIREDostop="openAccess"></VrstaEmbarga>
  <Osebe>
    <Oseba ID="77927" Ime="Matija" Priimek="Jerin" AltIme="" VlogaID="70" VlogaNaziv="Avtor" ConorID="" Afiliacija="" ArrsID="" ORCID=""></Oseba>
    <Oseba ID="47168" Ime="Mirjana" Priimek="Kljajić Borštnar" AltIme="" VlogaID="991" VlogaNaziv="Mentor" ConorID="" Afiliacija="" ArrsID="" ORCID=""></Oseba>
  </Osebe>
  <Identifikatorji>
    <Identifikator ID="3" Sifra="CobissID" Naziv="COBISS_ID" URL="https://plus.cobiss.net/cobiss/si/sl/bib/231923203">231923203</Identifikator>
  </Identifikatorji>
  <Relacije>
  </Relacije>
  <VerzijeGradiva>
  </VerzijeGradiva>
  <Datoteke>
    <Datoteka ID="187636" DatotekaNRID="14047458" NamenDatotekeID="2" NamenDatoteke="Predstavitvena datoteka" FormatDatotekeID="2" FormatDatoteke=".pdf" MIME="application/pdf" IkonaFormata="pdf.gif" IkonaFormataPolniUrl="https://dk.um.si/teme/dkumDev2/img/fileTypes/pdf.gif" VelikostDatoteke="5084370" VelikostDatotekeKratko="4,85 MB" DatumVstavljanja="2025-01-06 22:49:37" JeZbrisana="false" JeJavnoVidna="true" JeIndeksirana="true" JeVidno="true" VidnoOd="01.01.1970" Zaporedje="0">
      <Naziv>MAG_Jerin_Matija_2025.pdf</Naziv>
      <OrgNaziv>MAG_Jerin_Matija_2025.pdf</OrgNaziv>
      <URL></URL>
      <Opis></Opis>
      <OpisTujJezik></OpisTujJezik>
      <UrlObdelave></UrlObdelave>
      <FrekvencaAzuriranjaID>1</FrekvencaAzuriranjaID>
      <Verzija></Verzija>
      <MD5>966733DD4F7499945AEA26F3CADA8F72</MD5>
      <SHA256>4e3872d4e7916aff28341bf9b9364f961b11e60357b8da86000a0e981d713c7e</SHA256>
      <UUID>1f0e72e8-cc78-11ef-8cf7-00155d000105</UUID>
      <PID></PID>
      <PrenosPolniUrl>https://dk.um.si/Dokument.php?lang=slv&amp;id=187636</PrenosPolniUrl>
      <Vsebine>
        <Vsebina TipVsebine="GoloBesedilo" JezikID="1060" Oznaka="" Dolzina="80588"></Vsebina>
      </Vsebine>
    </Datoteka>
  </Datoteke>
  <Organizacije>
    <Organizacija OrganizacijaID="8" Kratica="FOV" ZavodEvsID="0000047" Logo="FOV_logo.gif" LogoPolniUrl="https://dk.um.si/teme/dkumDev2/img/logo/FOV_logo.gif">Fakulteta za organizacijske vede</Organizacija>
  </Organizacije>
  <OrganizacijeVira>
  </OrganizacijeVira>
  <MetodeZbiranjaPodatkov>
  </MetodeZbiranjaPodatkov>
  <TipologijaDela ID="2.09" Koda="2.09" Naziv="Magistrsko delo" SchemaOrg="Thesis"></TipologijaDela>
  <Ostalo>
    <StIrodsDatotek>0</StIrodsDatotek>
    <StDatotekPodTrajnimEmbargom>0</StDatotekPodTrajnimEmbargom>
    <StDatotekZOmejenimDostopom>0</StDatotekZOmejenimDostopom>
  </Ostalo>
</Gradivo>
