| | SLO | ENG | Piškotki in zasebnost

Večja pisava | Manjša pisava

Izpis gradiva Pomoč

Naslov:KLASIFIKACIJA SPLETNIH NOVIC S POMOČJO METOD PODATKOVNEGA RUDARJENJA V BESEDILU
Avtorji:ID Sandić, Mitja (Avtor)
ID Podgorelec, Vili (Mentor) Več o mentorju... Novo okno
Datoteke:.pdf UNI_Sandic_Mitja_2012.pdf (2,81 MB)
MD5: A765BD95164864A213627A9369BFB0D4
PID: 20.500.12556/dkum/3c56ddfe-f7ea-45fe-ab09-0313c42eada3
 
Jezik:Slovenski jezik
Vrsta gradiva:Diplomsko delo
Tipologija:2.11 - Diplomsko delo
Organizacija:FERI - Fakulteta za elektrotehniko, računalništvo in informatiko
Opis:Pogosto uporabniki interneta dobijo rezultat iskanja, ki vsebuje širok spekter dokumentov, a le nekaj je teh, ki so pomembni za njihove potrebe po informacijah. Za reševanje tega problema vedno več sistemov iskano informacijo organizira po ključu, ki je vsebinsko povezan s podatki. Poglejmo dva glavna avtomatska pristopa k organizaciji informacij: interaktivno povezovanje rezultatov iskanja (angl. clustering) in predkategoriziranje dokumentov, kjer zagotovimo hierarhično strukturo iskanja. Oba pristopa zahtevata v realnem svetu aplikacij učinkovite algoritme, ki se ubadajo s problematiko predstavitev dokumentov s sto ali več tisoč besedami. Problem se pojavi v tem, kako analizirati in obdelati takšno količino podatkov. V diplomskem delu bomo predstavili, kako dokumente pravilno pripraviti (zmanjšati vsebino dokumentov), ne da bi pri tem negativno vplivali na samo klasifikacijo. Poleg tega pa, kako z dodatnimi parametri zagotoviti še boljšo klasifikacijo.
Ključne besede:podatkovno rudarjenje v besedilih, klasifikacija, iskanje informacij.
Kraj izida:Maribor
Založnik:[M. Sandić]
Leto izida:2012
PID:20.500.12556/DKUM-23001 Novo okno
UDK:004.6:004.8(043.2)
COBISS.SI-ID:16177686 Novo okno
NUK URN:URN:SI:UM:DK:SVQQCGKG
Datum objave v DKUM:12.06.2012
Število ogledov:1923
Število prenosov:274
Metapodatki:XML DC-XML DC-RDF
Področja:KTFMB - FERI
:
Kopiraj citat
  
Skupna ocena:(0 glasov)
Vaša ocena:Ocenjevanje je dovoljeno samo prijavljenim uporabnikom.
Objavi na:Bookmark and Share



Postavite miškin kazalec na naslov za izpis povzetka. Klik na naslov izpiše podrobnosti ali sproži prenos.

Sekundarni jezik

Jezik:Angleški jezik
Naslov:WEB NEWS CLASSIFICATION USING TEXT MINING TECHNIQUES
Opis:Often users receive search results, which contain a wide range of documents, only some of which are relevant to their information needs. To address this problem, ever more systems not only locate information for users, but also organize that information on their behalf. We look at two main automatic approaches to information organization: interactive clustering of search results and pre-categorizing documents to provide hierarchical browsing structures. To be feasible in real world applications, both of these approaches require accurate yet efficient algorithms. Yet, both suffer from the curse of dimensionality -documents are typically represented by hundreds or thousands of words (features) which must be analyzed and processed during clustering or classification. In this paper, we discuss how to prepare (feature reduction techniques) documents and not to affect a classification. Also how with addition parameters improve efficiency as well as accuracy.
Ključne besede:text mining, classification, information retrieval.


Komentarji

Dodaj komentar

Za komentiranje se morate prijaviti.

Komentarji (0)
0 - 0 / 0
 
Ni komentarjev!

Nazaj
Logotipi partnerjev Univerza v Mariboru Univerza v Ljubljani Univerza na Primorskem Univerza v Novi Gorici