| | SLO | ENG | Piškotki in zasebnost

Večja pisava | Manjša pisava

Izpis gradiva Pomoč

Naslov:Utilizing large language models for cyber attack data generation : magistrsko delo
Avtorji:ID Zgaga, Bine (Avtor)
ID Beranič, Tina (Mentor) Več o mentorju... Novo okno
ID Kaymaz, Sevtap Duman (Komentor)
Datoteke:.pdf MAG_Zgaga_Bine_2026.pdf (3,40 MB)
MD5: 22AB2BECFA652F6BBDBC0C6F41A89C7D
 
Jezik:Angleški jezik
Vrsta gradiva:Magistrsko delo/naloga
Tipologija:2.09 - Magistrsko delo
Organizacija:FERI - Fakulteta za elektrotehniko, računalništvo in informatiko
Opis:This master’s thesis addresses the challenge of limited, imbalanced, and restricted-access datasets in the field of cybersecurity, which significantly hinder the development and evaluation of intrusion detection systems. To overcome these limitations, the thesis explores the use of synthetic data generation as a viable and effective alternative for producing realistic and diverse cyber-attack data while preserving privacy and improving dataset usability. The work presents a systematic review of existing approaches to synthetic data generation based on Generative Adversarial Networks and Large Language Models, analysing their fundamental characteristics, advantages, and limitations in the context of cyber-attack generation. Particular emphasis is placed on their suitability for creating realistic and diverse attack patterns relevant to intrusion detection research. The experimental part of the thesis investigates and compares multiple approaches to synthetic data generation, including standalone generative models and a combined methodology. The generated data are evaluated with respect to syntactic correctness, diversity, and practical applicability, supported by the introduction of a novel metric for assessing attack diversity. Additionally, the generated attacks are validated in a controlled test environment to assess their effectiveness in realistic scenarios. The results demonstrate that while individual generative approaches exhibit distinct strengths, their integration enables the most balanced and effective generation of synthetic cyber-attack data. The thesis concludes that combining Generative Adversarial Networks and Large Language Models provides a robust framework for producing realistic, diverse, and practically useful datasets, thereby contributing to the development of more reliable cybersecurity systems.
Ključne besede:large language models, attack data generation, artificial intelligence, cybersecurity
Kraj izida:Maribor
Kraj izvedbe:Maribor
Založnik:[B. Zgaga]
Leto izida:2026
Št. strani:1 spletni vir (1 datoteka PDF ([XXI], 67 str.))
PID:20.500.12556/DKUM-97077 Novo okno
UDK:004.6:004.8(043.2)
COBISS.SI-ID:281650179 Novo okno
Datum objave v DKUM:03.06.2026
Število ogledov:312
Število prenosov:13
Metapodatki:XML DC-XML DC-RDF
Področja:KTFMB - FERI
:
Kopiraj citat
  
Skupna ocena:(0 glasov)
Vaša ocena:Ocenjevanje je dovoljeno samo prijavljenim uporabnikom.
Objavi na:Bookmark and Share



Postavite miškin kazalec na naslov za izpis povzetka. Klik na naslov izpiše podrobnosti ali sproži prenos.

Licence

Licenca:CC BY 4.0, Creative Commons Priznanje avtorstva 4.0 Mednarodna
Povezava:http://creativecommons.org/licenses/by/4.0/deed.sl
Opis:To je standardna licenca Creative Commons, ki daje uporabnikom največ možnosti za nadaljnjo uporabo dela, pri čemer morajo navesti avtorja.
Začetek licenciranja:16.02.2026

Sekundarni jezik

Jezik:Slovenski jezik
Naslov:Uporaba velikih jezikovnih modelov za generiranje testnih podatkov
Opis:Magistrsko delo obravnava problem omejene dostopnosti kakovostnih, uravnoteženih in reprezentativnih podatkovnih zbirk na področju kibernetske varnosti, ki pomembno vpliva na razvoj in vrednotenje sistemov za zaznavanje vdorov. Zaradi zaupnosti, redkosti in neuravnoteženosti realnih podatkov se kot učinkovita alternativa uveljavlja uporaba sintetičnih podatkov, ki omogočajo varnejše raziskave, večjo raznolikost primerov ter boljše pokrivanje redkih, a za varnost kritičnih vrst napadov. V magistrskem delu je predstavljen pregled obstoječih metod generiranja sintetičnih podatkov z uporabo generativnih adversarialnih mrež in velikih jezikovnih modelov. Analizirane so njihove temeljne značilnosti, prednosti in omejitve pri ustvarjanju realističnih vzorcev kibernetskih napadov, s poudarkom na njihovi uporabnosti v sistemih za zaznavanje vdorov. Eksperimentalni del vključuje primerjavo različnih pristopov k generiranju sintetičnih podatkov, pri čemer so bili ti ovrednoteni z vidika sintaktične pravilnosti, raznolikosti in praktične uporabnosti. Razvita je bila tudi nova metrika za ocenjevanje raznolikosti napadov, ki omogoča objektivnejšo primerjavo med posameznimi metodami. Dodatno je bila izvedena praktična validacija v testnem okolju, ki je omogočila preverjanje učinkovitosti generiranih napadov v realističnih pogojih. Rezultati raziskave kažejo, da posamezni pristopi izkazujejo različne prednosti, pri čemer kombinacija generativnih adversarialnih mrež in velikih jezikovnih modelov omogoča najbolj uravnoteženo generiranje sintetičnih podatkov. Tak pristop omogoča ustvarjanje realističnih, raznolikih in uporabnih podatkovnih zbirk ter predstavlja pomemben prispevek k razvoju zanesljivejših sistemov za kibernetsko varnost.
Ključne besede:veliki jezikovni modeli, generiranje podatkov za napade, umetna inteligenca, kibernetska varnost


Komentarji

Dodaj komentar

Za komentiranje se morate prijaviti.

Komentarji (0)
0 - 0 / 0
 
Ni komentarjev!

Nazaj
Logotipi partnerjev Univerza v Mariboru Univerza v Ljubljani Univerza na Primorskem Univerza v Novi Gorici