Implementace metriky pro větvení v Isolation Forest
Implementation of split guiding metric for Isolation Forest
dc.contributor.advisor | Valenta Adam | |
dc.contributor.author | Maroš Kramár | |
dc.date.accessioned | 2023-06-09T22:52:03Z | |
dc.date.available | 2023-06-09T22:52:03Z | |
dc.date.issued | 2023-06-09 | |
dc.identifier | KOS-1240469473105 | |
dc.identifier.uri | http://hdl.handle.net/10467/108884 | |
dc.description.abstract | Detekcia anomálií je dôležitou súčasťou analýzy dát a strojového učenia so širokým spektrom využitia. V dobe, keď sa údaje spracúvajú v obrovských množstvách, môžu byť tradičné metódy výpočetne nákladné a nemusia byť dobre škálovateľné na veľkých, mnohodimenzionálnych dátových sadách. Isolation Forest je unikátny koncept, ktorý je založený na explicitnej izolácii anomálnych dátových bodov namiesto profilovania normálnych bodov. Postupom času boli objavnené niektoré obmedzenia tohto modelu a navrhnuté rozšírenia na ich odstránenie. V práci sú vybrané rozšírenia skúmané a experimentuje sa s ich kombináciou. Vybraná metóda je implementovaná do open-source platformy pre strojové učenie, H2O-3. Záver obsahuje vyhodnotenie novo pridanej implementácie, porovnanie s dvoma existujúcimi a diskusiu výsledkov. | cze |
dc.description.abstract | Anomaly detection is an important part of data analysis and machine learning with many applications. In an era, where data is being processed in massive quantities, traditional methods can be computationally expensive and may not scale well on large, high-dimensional datasets. The Isolation Forest is a unique concept, which is based on explicitly isolating anomalous data points rather than profiling normal ones. Over time, some limitations of the model have been discovered and some extensions have been proposed to address them. The thesis studies selected extensions and experiments with combining their approaches. The selected method is implemented into the H2O-3 open-source machine learning platform. The added implementation is evaluated against two existing implementations and the results are discussed. | eng |
dc.publisher | České vysoké učení technické v Praze. Vypočetní a informační centrum. | cze |
dc.publisher | Czech Technical University in Prague. Computing and Information Centre. | eng |
dc.rights | A university thesis is a work protected by the Copyright Act. Extracts, copies and transcripts of the thesis are allowed for personal use only and at one?s own expense. The use of thesis should be in compliance with the Copyright Act http://www.mkcr.cz/assets/autorske-pravo/01-3982006.pdf and the citation ethics http://knihovny.cvut.cz/vychova/vskp.html | eng |
dc.rights | Vysokoškolská závěrečná práce je dílo chráněné autorským zákonem. Je možné pořizovat z něj na své náklady a pro svoji osobní potřebu výpisy, opisy a rozmnoženiny. Jeho využití musí být v souladu s autorským zákonem http://www.mkcr.cz/assets/autorske-pravo/01-3982006.pdf a citační etikou http://knihovny.cvut.cz/vychova/vskp.html | cze |
dc.subject | Detekcia anomálií | cze |
dc.subject | nesupervizované učenie | cze |
dc.subject | Isolation Forest | cze |
dc.subject | Extended Isolation Forest | cze |
dc.subject | Fair Cut Forest | cze |
dc.subject | H2O.ai | cze |
dc.subject | Anomaly detection | eng |
dc.subject | unsupervised learning | eng |
dc.subject | Isolation Forest | eng |
dc.subject | Extended Isolation Forest | eng |
dc.subject | Fair Cut Forest | eng |
dc.subject | H2O.ai | eng |
dc.title | Implementace metriky pro větvení v Isolation Forest | cze |
dc.title | Implementation of split guiding metric for Isolation Forest | eng |
dc.type | diplomová práce | cze |
dc.type | master thesis | eng |
dc.contributor.referee | Vašata Daniel | |
theses.degree.discipline | Znalostní inženýrství | cze |
theses.degree.grantor | katedra aplikované matematiky | cze |
theses.degree.programme | Informatika | cze |
Soubory tohoto záznamu
Tento záznam se objevuje v následujících kolekcích
-
Diplomové práce - 18105 [194]