Análise e aplicações do algoritmo UMAP para classificação e redução de dimensionalidade de conjuntos de dados com múltiplas variáveis
| dc.contributor.advisor1 | Levada, Alexandre Luis Magalhães | |
| dc.contributor.advisor1Lattes | http://lattes.cnpq.br/3341441596395463 | por |
| dc.contributor.author | Calixto, Ariel Semensato | |
| dc.date.accessioned | 2023-04-05T18:48:31Z | |
| dc.date.available | 2023-04-05T18:48:31Z | |
| dc.date.issued | 2023-03-29 | |
| dc.description.abstract | Through many real-life applications, gathering information through real instruments subject to noise and imperfections tends to generate datasets where the number of observed variables and components easily exceeds a number of dimensions where manipulation, clustering and classification of said data into distinct sets based on their similarities becomes either difficult or computationally expensive. An efficient way to preemptively prepare this data for further processing and meaningful representation is dimensionality reduction, a process that transforms a dataset from a high-dimensional space to a low-dimensional space such as the low-dimensional space still retains relevant properties from the original dataset. This work proposes to evaluate the current state-of-the-art and establish, using performance criteria, comparisons between the frequently used dimensionality reduction used today and historically, with the main focus on UMAP, a method that seeks to prioritize the classification of data locally close by means of their characteristics. Results were obtained using different datasets with different properties, in order to obtain relevant metrics on the impact that each characteristic of these datasets has on the final results. | eng |
| dc.description.resumo | Em muitas aplicações reais, o levantamento de informações por meio de instrumentos reais, sujeitos à ruídos e imperfeições tende a gerar conjuntos de dados onde o número de variáveis e componentes observados facilmente excede um número de dimensões onde a manipulação, o agrupamento e a classificação desses dados em conjuntos distintos baseados em suas similaridades se tornam não intuitivos ou extremamente custosos computacionalmente. Uma forma eficiente de preparar esses dados de maneira preemptiva para futuros processamentos e representações significativas é a redução de dimensionalidade, um processo que transforma um conjunto de dados de um espaço de muitas dimensões para um espaço de poucas dimensões de forma que o espaço de poucas dimensões ainda possui propriedades relevantes do conjunto. Este trabalho propõe avaliar o atual estado da arte e estabelecer, utilizando critérios de desempenho, comparações entre os algoritmos de redução de dimensionalidade frequentemente utilizados atualmente e em um contexto histórico, com o foco principal no UMAP, um método que procura priorizar a classificação de conjuntos de dados localmente próximos por meio de suas características. Resultados foram obtidos utilizando diversos conjuntos de dados com propriedades diferentes, de forma a obter métricas relevantes sobre as influências que cada característica desses conjuntos possui nos resultados finais. | por |
| dc.description.sponsorship | Não recebi financiamento | por |
| dc.identifier.citation | CALIXTO, Ariel Semensato. Análise e aplicações do algoritmo UMAP para classificação e redução de dimensionalidade de conjuntos de dados com múltiplas variáveis. 2023. Trabalho de Conclusão de Curso (Graduação em Engenharia de Computação) – Universidade Federal de São Carlos, São Carlos, 2023. Disponível em: https://repositorio.ufscar.br/handle/20.500.14289/17623. | * |
| dc.identifier.uri | https://repositorio.ufscar.br/handle/20.500.14289/17623 | |
| dc.language.iso | por | por |
| dc.publisher | Universidade Federal de São Carlos | por |
| dc.publisher.address | Câmpus São Carlos | por |
| dc.publisher.course | Engenharia de Computação - EC | por |
| dc.publisher.initials | UFSCar | por |
| dc.rights | CC0 1.0 Universal | * |
| dc.rights.uri | http://creativecommons.org/publicdomain/zero/1.0/ | * |
| dc.subject | Redução de dimensionalidade | por |
| dc.subject | Classificação de conjuntos | por |
| dc.subject | Aprendizado de máquina | por |
| dc.subject | PCA | por |
| dc.subject | t-SNE | por |
| dc.subject | UMAP | por |
| dc.subject.cnpq | CIENCIAS EXATAS E DA TERRA::CIENCIA DA COMPUTACAO::METODOLOGIA E TECNICAS DA COMPUTACAO | por |
| dc.title | Análise e aplicações do algoritmo UMAP para classificação e redução de dimensionalidade de conjuntos de dados com múltiplas variáveis | por |
| dc.title.alternative | Analysis and applications of the UMAP algorithm for classification and dimensionality reduction of datasets with multiple variables | eng |
| dc.type | TCC | por |
Arquivos
Pacote Original
1 - 1 de 1
Carregando...
- Nome:
- Análise e aplicações do algoritmo UMAP para classificação e redução de dimensionalidade de conjuntos de dados com múltiplas variáveis.pdf
- Tamanho:
- 1.53 MB
- Formato:
- Adobe Portable Document Format
- Descrição: