<?xml version="1.0"?>
<rdf:RDF xmlns:rdf="http://www.w3.org/1999/02/22-rdf-syntax-ns#" xmlns:dc="http://purl.org/dc/elements/1.1/"><rdf:Description rdf:about="https://dk.um.si/IzpisGradiva.php?id=77700"><dc:title>Primerjava algoritmov za določanje sopojavnosti besed v besedilih</dc:title><dc:creator>Pal,	Klemen	(Avtor)
	</dc:creator><dc:creator>Holobar,	Aleš	(Mentor)
	</dc:creator><dc:creator>Ojsteršek,	Milan	(Komentor)
	</dc:creator><dc:creator>Ferme,	Marko	(Komentor)
	</dc:creator><dc:subject>algoritem</dc:subject><dc:subject>sopojavnost besed</dc:subject><dc:subject>besedilo</dc:subject><dc:subject>primerjava</dc:subject><dc:description>Glavna tema diplomske naloge je raziskovanje in primerjava nekaterih najbolj razširjenih algoritmov za določanje sopojavnosti besed v besedilih. Teoretično so razloženi pojavi kolokacij, njihova osnova in statistično ozadje. Nato so opisani trije najpogostejši algoritmi, ki slonijo na različnih pristopih: T-test, Pearsonov hi-kvadrat in algoritem PMI. Ti opisi so podprti s primeri izračuna vrednosti algoritmov. Praktični del vsebuje implementacijo predobdelave besedila in iskanja statističnih podatkov, sledi pa uporaba algoritmov nad temi podatki. Za konec je podana še primerjava teh algoritmov na osnovi dobljenih rezultatov.</dc:description><dc:publisher>[K. Pal]</dc:publisher><dc:date>2020</dc:date><dc:date>2020-09-10 12:12:42</dc:date><dc:type>Diplomsko delo/naloga</dc:type><dc:identifier>77700</dc:identifier><dc:language>sl</dc:language></rdf:Description></rdf:RDF>
