Extraktor informací o firmách z webových zdrojů
Extraction of company descriptors from web resources
dc.contributor.advisor | Kuchař Jaroslav | |
dc.contributor.author | Tomáš Stanovčák | |
dc.date.accessioned | 2022-06-02T22:54:20Z | |
dc.date.available | 2022-06-02T22:54:20Z | |
dc.date.issued | 2022-06-02 | |
dc.identifier | KOS-1179143728105 | |
dc.identifier.uri | http://hdl.handle.net/10467/101071 | |
dc.description.abstract | Předmětem této práce je získání a zpracování dat o firmách z jejich webových stránek. Po obeznámení se s přístupy extrakce a množinou dostupných firemních informací bude připraven datový soubor ve vhodném formátu, na kterém budou prováděny experimenty. Tato datová množina bude podrobena rozličným způsobům extrakce na principu pravidel i strojového učení. Výsledky experimentů budou vyhodnoceny a implementace jednotlivých přístupů zveřejněna jako knihovna pod volnou licencí. | cze |
dc.description.abstract | The subject of this thesis is to obtain and process company data from their websites. After getting acquainted with extraction approaches and available set of company information, dataset will be prepared in a format suitable for experiments. This dataset will undergo the extraction procedures based on both rule and machine learning principles. The results of the experiments will be evaluated and the implementation of the individual approaches will be publicly accessible as a library under a free licence. | eng |
dc.publisher | České vysoké učení technické v Praze. Vypočetní a informační centrum. | cze |
dc.publisher | Czech Technical University in Prague. Computing and Information Centre. | eng |
dc.rights | A university thesis is a work protected by the Copyright Act. Extracts, copies and transcripts of the thesis are allowed for personal use only and at one?s own expense. The use of thesis should be in compliance with the Copyright Act http://www.mkcr.cz/assets/autorske-pravo/01-3982006.pdf and the citation ethics http://knihovny.cvut.cz/vychova/vskp.html | eng |
dc.rights | Vysokoškolská závěrečná práce je dílo chráněné autorským zákonem. Je možné pořizovat z něj na své náklady a pro svoji osobní potřebu výpisy, opisy a rozmnoženiny. Jeho využití musí být v souladu s autorským zákonem http://www.mkcr.cz/assets/autorske-pravo/01-3982006.pdf a citační etikou http://knihovny.cvut.cz/vychova/vskp.html | cze |
dc.subject | firma | cze |
dc.subject | webová stránka | cze |
dc.subject | extrakce | cze |
dc.subject | vytěžování obsahu | cze |
dc.subject | web scraping | cze |
dc.subject | zpracování textu | cze |
dc.subject | Python | cze |
dc.subject | company | eng |
dc.subject | website | eng |
dc.subject | extraction | eng |
dc.subject | content mining | eng |
dc.subject | web scraping | eng |
dc.subject | text processing | eng |
dc.subject | Python | eng |
dc.title | Extraktor informací o firmách z webových zdrojů | cze |
dc.title | Extraction of company descriptors from web resources | eng |
dc.type | diplomová práce | cze |
dc.type | master thesis | eng |
dc.contributor.referee | Kordík Pavel | |
theses.degree.discipline | Znalostní inženýrství | cze |
theses.degree.grantor | katedra aplikované matematiky | cze |
theses.degree.programme | Informatika | cze |
Soubory tohoto záznamu
Tento záznam se objevuje v následujících kolekcích
-
Diplomové práce - 18105 [194]