{"id":{"repo_id":"brno-tech","oai_identifier":"oai:dspace.vut.cz:11012/258775"},"canonical_url":"https://search.dev.ndltd.org/etd/brno-tech/oai:dspace.vut.cz:11012/258775","repository":{"repo_id":"brno-tech","name":"Brno University of Technology","base_url":"https://dspace.vut.cz/oai/request"},"display":{"title":"Nástroj pro efektivní označování témat v textových kolekcích","abstract":"Manuální sémantická anotace rozsáhlých historických korpusů představuje pro badatele v digitálních humanitních vědách časově i kognitivně náročný proces. Tato práce představuje webový anotační nástroj, vyvinutý jako součást platformy semAnt, který integruje velké jazykové modely (LLM) a vektorové databáze pro realizaci asistovaného kódování v architektuře „Human-in-the-loop“ s využitím sémantického vyhledávání. Evaluace na historických periodikách prokázala nárůst informační výtěžnosti o 27,1 % a průměrnou úsporu času o 9,5 %. Mezianotátorská shoda se díky asistenci AI zvýšila o 23,3 %. Výsledkem je nástroj, který zefektivňuje analýzu textových dat a pomáhá sjednotit interpretaci komplexních sémantických kategorií.","abstract_html":"Manuální sémantická anotace rozsáhlých historických korpusů představuje pro badatele v digitálních humanitních vědách časově i kognitivně náročný proces. Tato práce představuje webový anotační nástroj, vyvinutý jako součást platformy semAnt, který integruje velké jazykové modely (LLM) a vektorové databáze pro realizaci asistovaného kódování v architektuře „Human-in-the-loop“ s využitím sémantického vyhledávání. Evaluace na historických periodikách prokázala nárůst informační výtěžnosti o 27,1 % a průměrnou úsporu času o 9,5 %. Mezianotátorská shoda se díky asistenci AI zvýšila o 23,3 %. Výsledkem je nástroj, který zefektivňuje analýzu textových dat a pomáhá sjednotit interpretaci komplexních sémantických kategorií.","abstract_has_math":false,"creators":["Juřica, Richard"],"institution":"Vysoké učení technické v Brně. Fakulta informačních technologií","degree_name":null,"degree_level":null,"degree_discipline":null,"degree_department":null,"school":null,"contributors":[],"advisors":["Hradiš, Michal"],"committee_chairs":[],"committee_members":[],"year":null,"date_issued":"","date_published":null,"updated_at":"2026-07-24T01:22:44Z","subjects":["kódování textu","sémantická anotace","analýza textu","zpracování přirozeného jazyka (NLP)","velké jazykové modely (LLM)","vektorové databáze","sémantické vyhledávání","digitální humanitní vědy","webový nástroj","Weaviate","FastAPI","Quasar","text coding","semantic annotation","text analysis","natural language processing (NLP)","large language models (LLM)","vector databases","semantic search","digital humanities","web tool"],"languages":["cs"],"rights":["Standardní licenční smlouva - přístup k plnému textu bez omezení"],"rights_urls":[],"identifier_entries":[{"key":"dc:identifier.other","label":"Dc Identifier Other","values":["170201"],"render_values":[{"text":"170201","href":null,"code":true}]}]},"links":{"outbound_url":"http://hdl.handle.net/11012/258775","outbound_label":"Handle","outbound_source":"dc:identifier.uri"},"metadata_groups":[{"id":"people","label":"People","entries":[{"key":"dc:contributor.advisor","label":"Advisor","values":["Hradiš, Michal"]},{"key":"dc:creator","label":"Author","values":["Juřica, Richard"]}]},{"id":"academic_context","label":"Academic Context","entries":[{"key":"dc:publisher","label":"Institution","values":["Vysoké učení technické v Brně. Fakulta informačních technologií"]},{"key":"dc:type","label":"Dc Type","values":["Text"]},{"key":"thesis:institution_name","label":"Thesis Institution Name","values":["Bc."]}]},{"id":"subjects_keywords","label":"Subjects and Keywords","entries":[{"key":"dc:subject","label":"Dc Subject","values":["kódování textu","sémantická anotace","analýza textu","zpracování přirozeného jazyka (NLP)","velké jazykové modely (LLM)","vektorové databáze","sémantické vyhledávání","digitální humanitní vědy","webový nástroj","Weaviate","FastAPI","Quasar","text coding","semantic annotation","text analysis","natural language processing (NLP)","large language models (LLM)","vector databases","semantic search","digital humanities","web tool"]}]},{"id":"language_rights","label":"Language and Rights","entries":[{"key":"dc:language.iso","label":"Language (ISO)","values":["cs"]},{"key":"dc:rights","label":"Dc Rights","values":["Standardní licenční smlouva - přístup k plnému textu bez omezení"]}]},{"id":"identifiers","label":"Identifiers","entries":[{"key":"dc:identifier.other","label":"Dc Identifier Other","values":["170201"]},{"key":"dc:identifier.uri","label":"Identifier URI","values":["http://hdl.handle.net/11012/258775"]}]},{"id":"additional","label":"Additional Metadata","entries":[{"key":"dc:description.abstract","label":"Abstract","values":["Manuální sémantická anotace rozsáhlých historických korpusů představuje pro badatele v digitálních humanitních vědách časově i kognitivně náročný proces. Tato práce představuje webový anotační nástroj, vyvinutý jako součást platformy semAnt, který integruje velké jazykové modely (LLM) a vektorové databáze pro realizaci asistovaného kódování v architektuře „Human-in-the-loop“ s využitím sémantického vyhledávání. Evaluace na historických periodikách prokázala nárůst informační výtěžnosti o 27,1 % a průměrnou úsporu času o 9,5 %. Mezianotátorská shoda se díky asistenci AI zvýšila o 23,3 %. Výsledkem je nástroj, který zefektivňuje analýzu textových dat a pomáhá sjednotit interpretaci komplexních sémantických kategorií.","Manual semantic annotation of large historical corpora represents a time-consuming and cognitively demanding process for digital humanities researchers. This thesis presents a web-based annotation tool, developed as a part of the semAnt platform, which integrates large language models (LLMs) and vector databases to implement assisted coding within a \"Human-in-the-loop\" architecture using semantic search. Evaluation on historical periodicals demonstrated a 27.1 % increase in information yield and an average time saving of 9.5 %. Inter-coder reliability increased by 23.3 % due to AI assistance. The result is a tool that streamlines the analysis of text data and helps unify the interpretation of complex semantic categories."]},{"key":"dc:title","label":"Title","values":["Nástroj pro efektivní označování témat v textových kolekcích"]}]}],"canonical_facts":{"dc:contributor.advisor":["Hradiš, Michal"],"dc:creator":["Juřica, Richard"],"dc:description.abstract":["Manuální sémantická anotace rozsáhlých historických korpusů představuje pro badatele v digitálních humanitních vědách časově i kognitivně náročný proces. Tato práce představuje webový anotační nástroj, vyvinutý jako součást platformy semAnt, který integruje velké jazykové modely (LLM) a vektorové databáze pro realizaci asistovaného kódování v architektuře „Human-in-the-loop“ s využitím sémantického vyhledávání. Evaluace na historických periodikách prokázala nárůst informační výtěžnosti o 27,1 % a průměrnou úsporu času o 9,5 %. Mezianotátorská shoda se díky asistenci AI zvýšila o 23,3 %. Výsledkem je nástroj, který zefektivňuje analýzu textových dat a pomáhá sjednotit interpretaci komplexních sémantických kategorií.","Manual semantic annotation of large historical corpora represents a time-consuming and cognitively demanding process for digital humanities researchers. This thesis presents a web-based annotation tool, developed as a part of the semAnt platform, which integrates large language models (LLMs) and vector databases to implement assisted coding within a \"Human-in-the-loop\" architecture using semantic search. Evaluation on historical periodicals demonstrated a 27.1 % increase in information yield and an average time saving of 9.5 %. Inter-coder reliability increased by 23.3 % due to AI assistance. The result is a tool that streamlines the analysis of text data and helps unify the interpretation of complex semantic categories."],"dc:identifier.other":["170201"],"dc:identifier.uri":["http://hdl.handle.net/11012/258775"],"dc:language.iso":["cs"],"dc:publisher":["Vysoké učení technické v Brně. Fakulta informačních technologií"],"dc:rights":["Standardní licenční smlouva - přístup k plnému textu bez omezení"],"dc:subject":["kódování textu","sémantická anotace","analýza textu","zpracování přirozeného jazyka (NLP)","velké jazykové modely (LLM)","vektorové databáze","sémantické vyhledávání","digitální humanitní vědy","webový nástroj","Weaviate","FastAPI","Quasar","text coding","semantic annotation","text analysis","natural language processing (NLP)","large language models (LLM)","vector databases","semantic search","digital humanities","web tool"],"dc:title":["Nástroj pro efektivní označování témat v textových kolekcích"],"dc:type":["Text"],"thesis:institution_name":["Bc."]},"updated_at":"2026-07-24T01:22:44Z"}