Vysoké učení technické v Brně. Fakulta informačních technologií
Hraní nedeterministických her s učením
Abstract
dc:description.abstractPráce se věnuje studiu a implementaci metod použitých pro učení z průběhu hraní. Zvolenou hrou pro tuhle práci jsou Vrhcáby. Algoritmus použitý pro učení neuronové sítě se nazývá učení z časového rozdílu s použitím stop vhodnosti. Tento algoritmus je známý i pod jménem TD(lambda). V teoretické části práce jsou popsány algoritmy pro hraní her bez učení, úvod do posilovaného učení, učení z časových rozdílů a úvod do umělých úvod neuronových sítí. Praktická část se zabývá aplikováním kombinace neuronových sítí a TD(lambda) algoritmů.
Degree
thesis:*- Grantor dc:publisher
- Vysoké učení technické v Brně. Fakulta informačních technologií
Author and committee
dc:creator, dc:contributor.*- Author dc:creator
-
- Bukovský, Marek
- Advisor dc:contributor.advisor
-
- Zbořil, František
Subjects
dc:subject × 12Rights
dc:rights- Statement dc:rights
-
- Standardní licenční smlouva - přístup k plnému textu bez omezení
- Language dc:language.iso
- cs
Identifiers
dc:identifier.*- Dc Identifier Other
- 42477
- OAI identifier oai:identifier
- oai:dspace.vut.cz:11012/54193