<?xml version="1.0" encoding="utf-8"?>
<Gradivo ID="23001" NadgradivoID="0" NRID="1017372" OceID="0" DomainUrl="https://dk.um.si/" IzpisPolniUrl="https://dk.um.si/IzpisGradiva.php?lang=slv&amp;id=23001" StOgledov="1923" StPrenosov="274" StOcen="0" VsotaOcen="0" DatumIzvoza="2026-10-01 10:18:53" OcenaSkupna="0" StPodgradiv="0" StudijskiProgramEvsID="" JeIndeksirano="0" JeVecAvtorjev="0" DovoliZahtevkeZaDostop="0">
  <PID Url="http://hdl.handle.net/20.500.12556/DKUM-23001">20.500.12556/DKUM-23001</PID>
  <Naslov>KLASIFIKACIJA SPLETNIH NOVIC S POMOČJO METOD PODATKOVNEGA RUDARJENJA V BESEDILU</Naslov>
  <Podnaslov></Podnaslov>
  <TujJezik_Naslov>WEB NEWS CLASSIFICATION USING TEXT MINING TECHNIQUES</TujJezik_Naslov>
  <TujJezik_Podnaslov></TujJezik_Podnaslov>
  <Opis>Pogosto uporabniki interneta dobijo rezultat iskanja, ki vsebuje širok spekter dokumentov, a le nekaj je teh, ki so pomembni za njihove potrebe po informacijah. Za reševanje tega problema vedno več sistemov iskano informacijo organizira po ključu, ki je vsebinsko povezan s podatki. Poglejmo dva glavna avtomatska pristopa k organizaciji informacij: interaktivno povezovanje rezultatov iskanja (angl. clustering) in predkategoriziranje dokumentov, kjer zagotovimo hierarhično strukturo iskanja. Oba pristopa zahtevata v realnem svetu aplikacij učinkovite algoritme, ki se ubadajo s problematiko predstavitev dokumentov s sto ali več tisoč besedami. Problem se pojavi v tem,  kako analizirati in obdelati takšno količino podatkov. V diplomskem delu bomo predstavili, kako dokumente pravilno pripraviti (zmanjšati vsebino dokumentov), ne da bi pri tem negativno vplivali na samo klasifikacijo. Poleg tega pa, kako z dodatnimi parametri zagotoviti še boljšo klasifikacijo.                  </Opis>
  <TujJezik_Opis>Often users receive search results, which contain a wide range of documents, only some of which are relevant to their information needs. To address this problem, ever more systems not only locate information for users, but also organize that information on their behalf. We look at two main automatic approaches to information organization: interactive clustering of search results and pre-categorizing documents to provide hierarchical browsing structures. To be feasible in real world applications, both of these approaches require accurate yet efficient algorithms. Yet, both suffer from the curse of dimensionality -documents are typically represented by hundreds or thousands of words (features) which must be analyzed and processed during clustering or classification. In this paper, we discuss how to prepare (feature reduction techniques) documents and not to affect a classification. Also how with addition parameters improve efficiency as well as accuracy.                  </TujJezik_Opis>
  <KljucneBesede>
    <Beseda>podatkovno rudarjenje v besedilih</Beseda>
    <Beseda>klasifikacija</Beseda>
    <Beseda>iskanje informacij.</Beseda>
  </KljucneBesede>
  <TujJezik_KljucneBesede>
    <Beseda>text mining</Beseda>
    <Beseda>classification</Beseda>
    <Beseda>information retrieval.</Beseda>
  </TujJezik_KljucneBesede>
  <Potrjeno>true</Potrjeno>
  <JeZaklenjeno>true</JeZaklenjeno>
  <JeRecenzirano>false</JeRecenzirano>
  <Zaloznik>[M. Sandić]</Zaloznik>
  <Izvor></Izvor>
  <Jezik ID="1060" ISO639-3="slv">Slovenski jezik</Jezik>
  <TujJezik ID="1033" ISO639-3="eng">Angleški jezik</TujJezik>
  <Povezave></Povezave>
  <Pokrivanje></Pokrivanje>
  <CasovnoPokritje></CasovnoPokritje>
  <AvtorskePravice></AvtorskePravice>
  <VrstaGradiva ID="m5" DRIVER="info:eu-repo/semantics/bachelorThesis">Diplomsko delo</VrstaGradiva>
  <DatumVstavljanja>2012-05-15 12:39:43</DatumVstavljanja>
  <DatumObjave>2012-06-12 11:51:47</DatumObjave>
  <DatumSpremembe>2022-04-14 12:16:49</DatumSpremembe>
  <DatumTrajnegaHranjenja>2023-12-31 03:16:06</DatumTrajnegaHranjenja>
  <LetoIzida>2012</LetoIzida>
  <LetoIzidaDo>0</LetoIzidaDo>
  <KrajIzida>Maribor</KrajIzida>
  <LetoIzvedbe>0</LetoIzvedbe>
  <KrajIzvedbe></KrajIzvedbe>
  <Opomba></Opomba>
  <StStrani></StStrani>
  <StevilcenjeNivo1></StevilcenjeNivo1>
  <StevilcenjeNivo2></StevilcenjeNivo2>
  <Kronologija></Kronologija>
  <Patent_Stevilka></Patent_Stevilka>
  <Patent_DatumVeljavnosti>0000-00-00</Patent_DatumVeljavnosti>
  <VerzijaDokumenta>NiDoloceno</VerzijaDokumenta>
  <StatusObjaveDrugje>NiDoloceno</StatusObjaveDrugje>
  <VrstaStroskaObjave>NiDoloceno</VrstaStroskaObjave>
  <DatumPoslanoVRecenzijo>0000-00-00</DatumPoslanoVRecenzijo>
  <DatumSprejetjaClanka>0000-00-00</DatumSprejetjaClanka>
  <DatumObjaveClanka>0000-00-00</DatumObjaveClanka>
  <EmbargoDo></EmbargoDo>
  <VrstaEmbarga ID="1" Naziv="Takojšnja javna objava" OpenAIREDostop="openAccess"></VrstaEmbarga>
  <Osebe>
    <Oseba ID="26380" Ime="Mitja" Priimek="Sandić" AltIme="" VlogaID="70" VlogaNaziv="Avtor" ConorID="" Afiliacija="" ArrsID="" ORCID=""></Oseba>
    <Oseba ID="365" Ime="Vili" Priimek="Podgorelec" AltIme="V. Podgorelec" VlogaID="991" VlogaNaziv="Mentor" ConorID="4402787" Afiliacija="" ArrsID="16304" ORCID=""></Oseba>
  </Osebe>
  <Identifikatorji>
    <Identifikator ID="4" Sifra="UDK" Naziv="UDK" URL="">004.6:004.8(043.2)</Identifikator>
    <Identifikator ID="3" Sifra="CobissID" Naziv="COBISS_ID" URL="https://plus.cobiss.net/cobiss/si/sl/bib/16177686">16177686</Identifikator>
    <Identifikator ID="18" Sifra="URN-NUK" Naziv="NUK URN" URL="">URN:SI:UM:DK:SVQQCGKG</Identifikator>
  </Identifikatorji>
  <Relacije>
  </Relacije>
  <VerzijeGradiva>
  </VerzijeGradiva>
  <Datoteke>
    <Datoteka ID="47554" DatotekaNRID="848194" NamenDatotekeID="2" NamenDatoteke="Predstavitvena datoteka" FormatDatotekeID="2" FormatDatoteke=".pdf" MIME="application/pdf" IkonaFormata="pdf.gif" IkonaFormataPolniUrl="https://dk.um.si/teme/dkumDev2/img/fileTypes/pdf.gif" VelikostDatoteke="2945761" VelikostDatotekeKratko="2,81 MB" DatumVstavljanja="2012-06-07 17:02:22" JeZbrisana="false" JeJavnoVidna="true" JeIndeksirana="true" JeVidno="true" VidnoOd="01.01.1970" Zaporedje="0">
      <Naziv>UNI_Sandic_Mitja_2012.pdf</Naziv>
      <OrgNaziv>UNI_Sandic_Mitja_2012.pdf</OrgNaziv>
      <URL></URL>
      <Opis></Opis>
      <OpisTujJezik></OpisTujJezik>
      <UrlObdelave></UrlObdelave>
      <FrekvencaAzuriranjaID>1</FrekvencaAzuriranjaID>
      <Verzija></Verzija>
      <MD5>A765BD95164864A213627A9369BFB0D4</MD5>
      <SHA256>1d4aa65d4c13a2013b406b2a0791cb84a0caa73a33c8025e69addad7d5b62943</SHA256>
      <UUID>9e7f080d-7c06-11eb-bb7a-00155d0001ca</UUID>
      <PID>20.500.12556/dkum/3c56ddfe-f7ea-45fe-ab09-0313c42eada3</PID>
      <PrenosPolniUrl>https://dk.um.si/Dokument.php?lang=slv&amp;id=47554</PrenosPolniUrl>
      <Vsebine>
        <Vsebina TipVsebine="GoloBesedilo" JezikID="1060" Oznaka="" Dolzina="105010"></Vsebina>
      </Vsebine>
    </Datoteka>
  </Datoteke>
  <Organizacije>
    <Organizacija OrganizacijaID="3" Kratica="FERI" ZavodEvsID="0000080" Logo="FERI_logo.gif" LogoPolniUrl="https://dk.um.si/teme/dkumDev2/img/logo/FERI_logo.gif">Fakulteta za elektrotehniko, računalništvo in informatiko</Organizacija>
  </Organizacije>
  <OrganizacijeVira>
  </OrganizacijeVira>
  <MetodeZbiranjaPodatkov>
  </MetodeZbiranjaPodatkov>
  <TipologijaDela ID="2.11" Koda="2.11" Naziv="Diplomsko delo" SchemaOrg="Thesis"></TipologijaDela>
  <Ostalo>
    <StIrodsDatotek>0</StIrodsDatotek>
    <StDatotekPodTrajnimEmbargom>0</StDatotekPodTrajnimEmbargom>
    <StDatotekZOmejenimDostopom>0</StDatotekZOmejenimDostopom>
  </Ostalo>
</Gradivo>
