<?xml version="1.0"?>
<metadata xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xmlns:dc="http://purl.org/dc/elements/1.1/"><dc:title>IZDELAVA PROGRAMSKEGA PAKETA ZA PRIDOBIVANJE IN PRIMERJANJE BESEDIL IZ INTERNETA</dc:title><dc:creator>Petek,	Matej	(Avtor)
	</dc:creator><dc:creator>Ojsteršek,	Milan	(Mentor)
	</dc:creator><dc:subject>procesiranje naravnega jezika</dc:subject><dc:subject>metapodatki</dc:subject><dc:subject>spletni pajki</dc:subject><dc:subject>OAI-PMH</dc:subject><dc:subject>detekcija plagiatov</dc:subject><dc:description>V diplomskem delu smo obdelali področje pridobivanja dokumentov iz različnih virov na internetu. V teoretičnem delu smo predstavili, kako delujejo spletni pajki, strežniki OAI-PMH in OAI-ORE ter orodje Appache Tika, ki omogoča pretvorbo različnih vrst dokumentov v tekstovno obliko in ekstrakcijo metapodatkov. Zatem smo na kratko predstavili naloge, ki jih rešujejo sistemi za obdelavo besedil v naravnem jeziku. V praktičnem delu smo izdelali programski paket za pridobivanje dokumentov iz interneta in primerjanje besedil iz teh dokumentov.            </dc:description><dc:publisher>[M. Petek]</dc:publisher><dc:date>2012</dc:date><dc:date>2012-03-05 12:50:56</dc:date><dc:type>Diplomsko delo</dc:type><dc:identifier>22262</dc:identifier><dc:identifier>UDK: 004.774.6(043.2)</dc:identifier><dc:identifier>COBISS_ID: 16168470</dc:identifier><dc:identifier>NUK URN: URN:SI:UM:DK:HAIAZ9MM</dc:identifier><dc:language>sl</dc:language></metadata>
