<?xml version="1.0"?>
<metadata xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xmlns:dc="http://purl.org/dc/elements/1.1/"><dc:title>Analiza uporabe in postavitve podatkovnega jezera</dc:title><dc:creator>Koren,	Marcel	(Avtor)
	</dc:creator><dc:creator>Kamišalić Latifić,	Aida	(Mentor)
	</dc:creator><dc:creator>Šestak,	Martina	(Komentor)
	</dc:creator><dc:subject>velepodatki</dc:subject><dc:subject>podatkovna jezera</dc:subject><dc:subject>Hadoop</dc:subject><dc:subject>Spark</dc:subject><dc:subject>Azure Data Lake</dc:subject><dc:description>Velepodatki in podatkovna jezera sta pojma, ki jih v zadnjih letih vedno pogosteje uporabljamo v povezavi s porastom količine ustvarjenih podatkov. V magistrskem delu predstavljamo lastnosti podatkovnih jezer, čemu so namenjena, kako jih lahko vzpostavimo ter kako so povezana z velepodatki. Podrobno opišemo odprtokodno rešitev Apache Hadoop in oblačno rešitev Microsoft Azure Data Lake. Pri tem smo spoznali tudi orodja, ki jih rešitvi ponujata, med katerimi sta pomembnejši Apache Spark in Azure Databricks. V nadaljevanju predstavljamo, kako ju vzpostavimo ter izvedemo eksperiment, kjer na podlagi hitrosti izvajanja in stroškov spoznamo njune prednosti in slabosti.</dc:description><dc:publisher>[M. Koren]</dc:publisher><dc:date>2021</dc:date><dc:date>2021-11-03 13:25:47</dc:date><dc:type>Magistrsko delo/naloga</dc:type><dc:identifier>80869</dc:identifier><dc:identifier>UDK: 004.65+004.76(043.2)</dc:identifier><dc:identifier>COBISS_ID: 97445635</dc:identifier><dc:language>sl</dc:language></metadata>
