<?xml version="1.0"?>
<metadata xmlns:xsi="http://www.w3.org/2001/XMLSchema-instance" xmlns:dc="http://purl.org/dc/elements/1.1/"><dc:title>Zajemanje in obdelava besedila iz slik z uporabo tehnologij optičnega prepoznavanja znakov in transformerskih modelov za tolmačenje dokumentov</dc:title><dc:creator>Kajba,	Tjan	(Avtor)
	</dc:creator><dc:creator>Novak,	Damijan	(Mentor)
	</dc:creator><dc:subject>multimodalni veliki jezikovni modeli</dc:subject><dc:subject>optično prepoznavanje znakov</dc:subject><dc:subject>transformerski modeli za razumevanje dokumentov</dc:subject><dc:subject>veliki jezikovni modeli</dc:subject><dc:subject>zajemanje besedila s slik</dc:subject><dc:description>Informacije imajo dandanes ključno vlogo v digitalnem svetu. Tehnologije zajemanja besedila s slik so ključna rešitev za pretvorbo fizičnih medijev v digitalno obliko. Teoretični del diplomskega dela predstavlja, kaj so omenjene tehnologije in kako jih razvrščamo. V nadaljevanju smo prikazali delovanje posameznih podvrst orodij, tako tistih, ki temeljijo na velikih jezikovnih modelih, kot tudi tistih brez njih ter njihove priporočene uporabe. Proti koncu teoretičnega dela smo izvedli primerjalno analizo različnih tehnologij. Na podlagi rezultata analize je bil izbran transformerski model za razumevanje dokumentov kot osnova aplikacije. Praktični del prikazuje ustvarjeno aplikacijo, namenjeno branju računov.</dc:description><dc:publisher>[T. Kajba]</dc:publisher><dc:date>2025</dc:date><dc:date>2025-08-22 17:24:11</dc:date><dc:type>Diplomsko delo/naloga</dc:type><dc:identifier>94618</dc:identifier><dc:identifier>UDK: 004.932(043.2)</dc:identifier><dc:identifier>COBISS_ID: 271053315</dc:identifier><dc:language>sl</dc:language></metadata>
