<?xml version="1.0"?>
<rdf:RDF xmlns:rdf="http://www.w3.org/1999/02/22-rdf-syntax-ns#" xmlns:dc="http://purl.org/dc/elements/1.1/"><rdf:Description rdf:about="https://dk.um.si/IzpisGradiva.php?id=71768"><dc:title>Porazdeljeno generiranje poročil detektorja plagiatov</dc:title><dc:creator>Fartek,	Jože	(Avtor)
	</dc:creator><dc:creator>Ojsteršek,	Milan	(Mentor)
	</dc:creator><dc:subject>porazdeljeno procesiranje</dc:subject><dc:subject>koncept »MapReduce«</dc:subject><dc:subject>NoSQL</dc:subject><dc:subject>detekcija podobnih vsebin</dc:subject><dc:description>Ker je relacijske podatkovne baze za hranjenje velike količine izvlečkov iz besedil in generiranje poročil detektorja podobnih vsebin težko horizontalno razširiti, smo za ta namen raziskali možnost uporabe podatkovnih baz NoSQL. Preizkusili smo več podatkovnih baz in izbrali najprimernejšo. Implementirali smo tudi nekaj algoritmov, ki so primerni za ugotavljanje podobnosti v parafraziranih besedilih in temeljijo na tvorjenju izvlečkov iz besedil s pomočjo normaliziranih n-gramov. Te algoritme smo primerjali z algoritmom za tvorjenje izvlečkov, ki se na Univerzi v Mariboru uporablja za detekcijo podobnih dokumentov. Po izbiri najustreznejše podatkovne baze NoSQL in algoritma za tvorjenje izvlečkov, smo implementirali prototip porazdeljenega sistema za ugotavljanje podobnih dokumentov in generiranje poročil detektorja podobnih vsebin.</dc:description><dc:publisher>J. Fartek</dc:publisher><dc:date>2018</dc:date><dc:date>2018-08-29 16:50:07</dc:date><dc:type>Diplomsko delo/naloga</dc:type><dc:identifier>71768</dc:identifier><dc:language>sl</dc:language></rdf:Description></rdf:RDF>
