Implementace metriky pro větvení v Isolation Forest
Implementation of split guiding metric for Isolation Forest
Type of document
diplomová prácemaster thesis
Author
Maroš Kramár
Supervisor
Valenta Adam
Opponent
Vašata Daniel
Field of study
Znalostní inženýrstvíStudy program
InformatikaInstitutions assigning rank
katedra aplikované matematikyRights
A university thesis is a work protected by the Copyright Act. Extracts, copies and transcripts of the thesis are allowed for personal use only and at one?s own expense. The use of thesis should be in compliance with the Copyright Act http://www.mkcr.cz/assets/autorske-pravo/01-3982006.pdf and the citation ethics http://knihovny.cvut.cz/vychova/vskp.htmlVysokoškolská závěrečná práce je dílo chráněné autorským zákonem. Je možné pořizovat z něj na své náklady a pro svoji osobní potřebu výpisy, opisy a rozmnoženiny. Jeho využití musí být v souladu s autorským zákonem http://www.mkcr.cz/assets/autorske-pravo/01-3982006.pdf a citační etikou http://knihovny.cvut.cz/vychova/vskp.html
Metadata
Show full item recordAbstract
Detekcia anomálií je dôležitou súčasťou analýzy dát a strojového učenia so širokým spektrom využitia. V dobe, keď sa údaje spracúvajú v obrovských množstvách, môžu byť tradičné metódy výpočetne nákladné a nemusia byť dobre škálovateľné na veľkých, mnohodimenzionálnych dátových sadách. Isolation Forest je unikátny koncept, ktorý je založený na explicitnej izolácii anomálnych dátových bodov namiesto profilovania normálnych bodov. Postupom času boli objavnené niektoré obmedzenia tohto modelu a navrhnuté rozšírenia na ich odstránenie. V práci sú vybrané rozšírenia skúmané a experimentuje sa s ich kombináciou. Vybraná metóda je implementovaná do open-source platformy pre strojové učenie, H2O-3. Záver obsahuje vyhodnotenie novo pridanej implementácie, porovnanie s dvoma existujúcimi a diskusiu výsledkov. Anomaly detection is an important part of data analysis and machine learning with many applications. In an era, where data is being processed in massive quantities, traditional methods can be computationally expensive and may not scale well on large, high-dimensional datasets. The Isolation Forest is a unique concept, which is based on explicitly isolating anomalous data points rather than profiling normal ones. Over time, some limitations of the model have been discovered and some extensions have been proposed to address them. The thesis studies selected extensions and experiments with combining their approaches. The selected method is implemented into the H2O-3 open-source machine learning platform. The added implementation is evaluated against two existing implementations and the results are discussed.
Collections
- Diplomové práce - 18105 [194]
Related items
Showing items related by title, author, creator and subject.
-
Zdokonalení metod znalostního inženýrství používaných pro včasnou detekci říje u skotu
Author: Veselý David; Supervisor: Holeňa Martin; Opponent: Borovička Tomáš
(České vysoké učení technické v Praze. Vypočetní a informační centrum.Czech Technical University in Prague. Computing and Information Centre., 2015-06-08)Tato práce se zabývá výzkumem včasné detekce říje krav na moderních automatizovaných farmách. Jejím cílem je porovnat vybrané techniky znalostního inženýrství s referenčním řešením. Mezi zkoumané techniky patří především: ... -
Predikce kardiální autonomní neuropatie u pacientů s diabetem
Author: Benešová Michaela; Supervisor: Novák Jakub; Opponent: Lhotská Lenka
(České vysoké učení technické v Praze. Vypočetní a informační centrum.Czech Technical University in Prague. Computing and Information Centre., 2016-05-17)Prace se zabyva analyzou medicnskych dat, jejich predzpracovanm a konstrukc -
Predikce kriminality
Author: Maurerová Veronika; Supervisor: Kordík Pavel; Opponent: Hořínek Jan
(České vysoké učení technické v Praze. Vypočetní a informační centrum.Czech Technical University in Prague. Computing and Information Centre., 2017-05-09)S důrazem na efektivitu práce a s vzrůstajícím zájmem o zpracování dat, strojové učení a umělou inteligenci, se prediktivní analýza stává součástí policejních aktivit, predevším v oblasti prevence kriminality. Například ...