Vysoké učení technické v Brně. Fakulta informačních technologií
Reprezentace textu a její vliv na kategorizaci
Abstract
dc:description.abstractDiplomová práce se zabývá strojovým zpracováním textových dat. V teoretické části jsou popsány problémy související se zpracováním přirozeného jazyka a dále jsou představeny různé způsoby předzpracování a reprezentace textu. Práce se také blíže věnuje použití N-gramů jako rysů pro reprezentaci dokumentů a popisuje některé algoritmy sloužící pro jejich extrakci. Další část je pak věnována přehledu používaných klasifikačních metod. V rámci praktické části práce byla navržena a implementována aplikace sloužící pro předzpracování a vytváření různých reprezentací textových dat. V rámci experimentů je pak sledován vliv těchto reprezentací na úspěšnost klasifikačních algoritmů.
Degree
thesis:*- Grantor dc:publisher
- Vysoké učení technické v Brně. Fakulta informačních technologií
Author and committee
dc:creator, dc:contributor.*- Author dc:creator
-
- Šabatka, Ondřej
- Advisor dc:contributor.advisor
-
- Bartík, Vladimír
Subjects
dc:subject × 15Rights
dc:rights- Statement dc:rights
-
- Přístup k plnému textu prostřednictvím internetu byl licenční smlouvou omezen na dobu 1 roku/let
- Language dc:language.iso
- cs
Identifiers
dc:identifier.*- Dc Identifier Other
- 34998
- OAI identifier oai:identifier
- oai:dspace.vut.cz:11012/54406