<?xml version="1.0"?>
<rdf:RDF xmlns:rdf="http://www.w3.org/1999/02/22-rdf-syntax-ns#" xmlns:dc="http://purl.org/dc/elements/1.1/"><rdf:Description rdf:about="https://dk.um.si/IzpisGradiva.php?id=22262"><dc:title>IZDELAVA PROGRAMSKEGA PAKETA ZA PRIDOBIVANJE IN PRIMERJANJE BESEDIL IZ INTERNETA</dc:title><dc:creator>Petek,	Matej	(Avtor)
	</dc:creator><dc:creator>Ojsteršek,	Milan	(Mentor)
	</dc:creator><dc:subject>procesiranje naravnega jezika</dc:subject><dc:subject>metapodatki</dc:subject><dc:subject>spletni pajki</dc:subject><dc:subject>OAI-PMH</dc:subject><dc:subject>detekcija plagiatov</dc:subject><dc:description>V diplomskem delu smo obdelali področje pridobivanja dokumentov iz različnih virov na internetu. V teoretičnem delu smo predstavili, kako delujejo spletni pajki, strežniki OAI-PMH in OAI-ORE ter orodje Appache Tika, ki omogoča pretvorbo različnih vrst dokumentov v tekstovno obliko in ekstrakcijo metapodatkov. Zatem smo na kratko predstavili naloge, ki jih rešujejo sistemi za obdelavo besedil v naravnem jeziku. V praktičnem delu smo izdelali programski paket za pridobivanje dokumentov iz interneta in primerjanje besedil iz teh dokumentov.            </dc:description><dc:publisher>[M. Petek]</dc:publisher><dc:date>2012</dc:date><dc:date>2012-03-05 12:50:56</dc:date><dc:type>Diplomsko delo</dc:type><dc:identifier>22262</dc:identifier><dc:language>sl</dc:language></rdf:Description></rdf:RDF>
