Reconocimiento 4.0 InternacionalBranch Bedoya, John WillianIral Palomino, RenéOliveros Duran, Daniel Alejandro2025-07-092025-07-092025https://repositorio.unal.edu.co/handle/unal/88315Ilustraciones, gráficosEn el contexto actual, la disponibilidad creciente de herramientas para el análisis y la visualización estadística ha facilitado significativamente la exploración de datos y sus relaciones. No obstante, el incremento exponencial en la complejidad y el volumen de los datos plantea desafíos considerables, especialmente en el tratamiento de variables categóricas. Estas variables exhiben desafíos particulares en términos de representación gráfica, integración en modelos analíticos y en la interpretación de los resultados. Entre los principales desafíos que se destacan se encuentran la alta cardinalidad, que genera combinaciones complejas y dificulta el análisis individual de cada categoría, así como el incremento de la dimensionalidad derivado de técnicas de codificación como el one-hot encoding. El propósito de este estudio es desarrollar un procedimiento de visualización para datos categóricos con alta cardinalidad y dimensionalidad. Para lograr este objetivo, se propone un enfoque que abarca el procesamiento y la selección de variables categóricas, con el propósito de facilitar la aplicación de técnicas de reducción de dimensionalidad. Posteriormente, se determinará un método de visualización adecuado para representar el conjunto de datos reducido, de manera que sea posible analizar las relaciones entre las variables categóricas en un espacio de menor dimensión. (Tomado de la fuente)In the current context, the increasing availability of tools for statistical analysis and visualization has significantly facilitated the exploration of data and their relationships. However, the exponential increase in the complexity and volume of data poses considerable challenges, especially in the treatment of categorical variables. These variables exhibit particular challenges in terms of graphical representation, integration into analytical models, and interpretation of results. Among the main challenges are high cardinality, which generates complex combinations and makes the individual analysis of each category difficult, as well as increased dimensionality derived from coding techniques such as one-hot encoding. The purpose of this study is to develop a visualization procedure for categorical data with high cardinality and dimensionality. To achieve this objective, an approach is proposed that encompasses the processing and selection of categorical variables, with the purpose of facilitating the application of dimensionality reduction techniques. Subsequently, a suitable visualization method will be determined to represent the reduced data set, so that it will be possible to analyze the relationships between categorical variables in a lower dimensional space.95 páginasapplication/pdfspahttp://creativecommons.org/licenses/by/4.0/510 - Matemáticas::519 - Probabilidades y matemáticas aplicadas000 - Ciencias de la computación, información y obras generales::006 - Métodos especiales de computaciónVisualización de datos categóricos empleando métodos de reducción de dimensionalidad enfocados en datos socioeconómicosTrabajo de grado - MaestríaUniversidad Nacional de ColombiaRepositorio Institucional Universidad Nacional de Colombiahttps://repositorio.unal.edu.co/info:eu-repo/semantics/openAccessMétodos estadísticosAnálisis estadísticoReducción de datosVariables (Estadística)Análisis multivarianteSistemas de recolección automática de datosSituación socioeconómica - Procesamiento de datosAplicaciones analíticasReducción de dimensionalidadVisualizaciónClasificación socioeconómicaDatos CategóricosSocioeconomic classificationDimensionality reductionEmbeddingsSocioeconomic dataCategorical dataVisualizing categorical data using dimensionality reduction methods focused on socioeconomic data