| | SLO | ENG | Piškotki in zasebnost

Večja pisava | Manjša pisava

Izpis gradiva Pomoč

Naslov:Izdelava oblikoslovnega označevalnika za slovenski jezik in primerjava z drugimi rešitvami
Avtorji:ID Hrovat, Goran (Avtor)
ID Ojsteršek, Milan (Mentor) Več o mentorju... Novo okno
Datoteke:.pdf UNI_Hrovat_Goran_2010.pdf (1,68 MB)
MD5: 5D87E7199C7C416EE602153BE2309DF0
PID: 20.500.12556/dkum/6a49246f-cab7-412d-af10-3cdb0e17676e
 
Jezik:Slovenski jezik
Vrsta gradiva:Diplomsko delo
Organizacija:FERI - Fakulteta za elektrotehniko, računalništvo in informatiko
Opis:V diplomskem delu smo se ukvarjali s področjem računalniško podprtega oblikoslovnega označevanja besedil v slovenskem jeziku. Najprej smo opisali napogostejše probleme, ki se pojavljajo. Nato smo opisali delovanje dveh odprtokodnih oblikoslovnih ozna čevalnikov: Stanford POS Tagger in TreeTagger. V praktičnem delu smo izdelali lastni oblikoslovni ozna čevalnik in prilagodili odprtokodna ozna čevalnika za procesiranje besedil v slovenskem jeziku. Učno mno žico je predstavljal korpus FidaPlus. Rezultate oblikoslovnega označevanja iz vseh treh označevalnikov smo med seboj primerjali.
Ključne besede:oblikoslovno označevanje, procesiranje naravnega jezika, NLP, naravni jezik, slovenski jezik, lematizacija
Kraj izida:Maribor
Založnik:[G. Hrovat]
Leto izida:2010
PID:20.500.12556/DKUM-14271 Novo okno
UDK:004.93:811.163.6(043.2)
COBISS.SI-ID:14305302 Novo okno
NUK URN:URN:SI:UM:DK:YSIMUXFV
Datum objave v DKUM:21.06.2010
Število ogledov:3794
Število prenosov:276
Metapodatki:XML DC-XML DC-RDF
Področja:KTFMB - FERI
:
Kopiraj citat
  
Skupna ocena:(0 glasov)
Vaša ocena:Ocenjevanje je dovoljeno samo prijavljenim uporabnikom.
Objavi na:Bookmark and Share



Postavite miškin kazalec na naslov za izpis povzetka. Klik na naslov izpiše podrobnosti ali sproži prenos.

Sekundarni jezik

Jezik:Angleški jezik
Naslov:DEVELOPING A POS TAGGER FOR SLOVENIAN LANGUAGE AND COMPARING TO OTHER SOLUTIONS
Opis:In this diploma work, we elaborated automatic POS tagging of Slovenian text. First of all, we presented common problems and described two open source POS taggers: Stanford POS tagger and TreeTagger. As a practical part, we developed our own POS tagger and adapted the tested open source taggers to work on Slovene text. We used FidaPlus corpus as a training set. Finally, we compared the results of all three POS taggers.
Ključne besede:POS tagging, part of speech, NLP, natural language, natural language processing, lemmatisation, slovenian language


Komentarji

Dodaj komentar

Za komentiranje se morate prijaviti.

Komentarji (0)
0 - 0 / 0
 
Ni komentarjev!

Nazaj
Logotipi partnerjev Univerza v Mariboru Univerza v Ljubljani Univerza na Primorskem Univerza v Novi Gorici