Vysoké učení technické v Brně. Fakulta elektrotechniky a komunikačních technologií
Taxonomie pro LLM v komponentě Kafka projektu Apache Camel
Abstract
dc:description.abstractTato práce se zaměřuje na koncept umělé inteligence, konkrétně na velké jazykové modely (Large Language Models). Popisuje základní principy neuronových sítí a fáze trénování v oblasti umělé inteligence, strojového učení a jazykových modelů, přičemž se zabývá i výzvami efektivního trénování neuronových sítí. Práce dále zkoumá komponentu Kafka pro Apache Camel, její význam a využitelnost v kontextu trénování jazykových modelů. Hlavní část této práce se věnuje tvorbě taxonomie, která je klíčovým prvkem v procesu učení. Program pro extrakci a Annotation API mají produktovou kvalitu a byly napsány v jazyce Java. Práce ukazuje proces generování syntetických dat na základě poskytnuté kvalitativní taxonomie pomocí nástroje InstructLab a analýzu výsledků. Součástí práce je také ukázka procesu nasazení taxonomie na serveru Hugging Face.
Degree
thesis:*- Grantor dc:publisher
- Vysoké učení technické v Brně. Fakulta elektrotechniky a komunikačních technologií
Author and committee
dc:creator, dc:contributor.*- Author dc:creator
-
- Konovalov, Nikita
- Advisor dc:contributor.advisor
-
- Phan, Viet Anh
Subjects
dc:subject × 23- Umělá inteligence
- strojové učení
- hluboké učení
- velký jazykový model
- zpracování přirozeného jazyka
- dataset
- model
- komponenta Kafka
- Apache Camel
- útržek kódu
- syntetická data
- InstructLab
- Hugging Face
- taxonomie.
- Artificial Intelligence
- Machine Learning
- Deep Learning
- Large Language Model
- Natural Language Processing
- Kafka component
- code snippet
- synthetic data
- taxonomy.
Rights
dc:rights- Statement dc:rights
-
- Standardní licenční smlouva - přístup k plnému textu bez omezení
- Language dc:language.iso
- en
Identifiers
dc:identifier.*- Dc Identifier Other
- 167353
- OAI identifier oai:identifier
- oai:dspace.vut.cz:11012/252973