En 21 día(s), 14 hora(s) y 25 minuto(s): El Repositorio Institucional UNAL informa a la comunidad universitaria que, con motivo del periodo de vacaciones colectivas, el servicio de publicación estará suspendido: Periodo de cierre: Del 20 de diciembre al 18 de enero de 2026. Sobre los depósitos: Durante este tiempo, los usuarios podrán continuar realizando el depósito respectivo de sus trabajos en la plataforma. Reanudación: Una vez reiniciadas las actividades administrativas, los documentos serán revisados y publicados en orden de llegada.

Modelo basado en minería de flujos de datos para el análisis de clics en un sitio web / A model based on data streams mining to clickstream analysis in a website

dc.contributorLeón Guzmán, Elizabethspa
dc.contributor.authorRojas Hernández, Alix Éricaspa
dc.date.accessioned2019-06-24T23:58:49Zspa
dc.date.available2019-06-24T23:58:49Zspa
dc.date.issued2010spa
dc.description.abstractEn este documento se propone un modelo de minería enfocado al procesamiento de flujos de datos. Tratar con flujos de datos (o data streams, en inglés) trae retos computacionales debido a su volumen y su tasa de generación rápida y variable. Los datos en un flujo no pueden ser almacenados, ni mucho menos, procesados eficientemente utilizando procedimientos que requieran usar un dato varias veces. Para esto se propone el desarrollo de un modelo llamado SCOFI, que por sus siglas en inglés traduce Streaming Clasification based On Frequent Itemsets. Su diseño general presenta dos módulos funcionales: un módulo de selección y asociación y un módulo de clasificación. Para el primer módulo se propone el algoritmo Apriori+, que encuentra conjuntos de elementos frecuentes calculando el número de candidatos primos, cambiando así, la representación de los datos para obtener un problema más sencillo en el dominio de los números naturales. En el módulo de clasificación se usa una modificación del algoritmo M1 para construir el clasificador a partir de reglas de asociación. Finalmente, el modelo se aplica al análisis de clics generados en un sitio Web real. Para ello se emplea el conjunto de datos “Online retailer website clickstream analysis” de la KDD-Cup 2000 y se simula un ambiente en línea, con el fin de validar el modelo. / Abstract: In this document, a data mining model to process data streams is proposed. Dealing with data streams carries computational challenges since they cannot be stored or processed efficiently through procedures that use data several times because, data arrival rate and speed is variable and the volume is high. The proposed model is named SCOFI - Streaming Classification based On Frequent Item sets. Its general design relies on two functional modules: selection and association module and classification module. For the first module it is proposed the algorithm Apriori+. This algorithm finds frequent item sets calculating the amount of prime candidates; so that, it changes the data representation in order to get a simpler problem in the natural numbers domain. In the classification model it is used a modification of the M1 algorithm in order to build a classifier based on association rules. Finally, the model is applied to click stream analysis from real data. For this, the "Online retailer website click stream analysis" data set from KDD-Cup 2000 is used, and simulated an online environment for model validation.spa
dc.description.degreelevelMaestríaspa
dc.format.mimetypeapplication/pdfspa
dc.identifier.eprintshttp://bdigital.unal.edu.co/8840/spa
dc.identifier.urihttps://repositorio.unal.edu.co/handle/unal/11417
dc.language.isospaspa
dc.relation.ispartofUniversidad Nacional de Colombia Sede Bogotá Facultad de Ingeniería Departamento de Ingeniería de Sistemas e Industrialspa
dc.relation.ispartofDepartamento de Ingeniería de Sistemas e Industrialspa
dc.relation.referencesRojas Hernández, Alix Érica (2010) Modelo basado en minería de flujos de datos para el análisis de clics en un sitio web / A model based on data streams mining to clickstream analysis in a website. Maestría thesis, Universidad Nacional de Colombia.spa
dc.rightsDerechos reservados - Universidad Nacional de Colombiaspa
dc.rights.accessrightsinfo:eu-repo/semantics/openAccessspa
dc.rights.licenseAtribución-NoComercial 4.0 Internacionalspa
dc.rights.urihttp://creativecommons.org/licenses/by-nc/4.0/spa
dc.subject.ddc0 Generalidades / Computer science, information and general worksspa
dc.subject.proposalFlujos de datosspa
dc.subject.proposalMinería de datosspa
dc.subject.proposalAnálisis de clics / Data streamsspa
dc.subject.proposalData miningspa
dc.subject.proposalClickstream analysisspa
dc.titleModelo basado en minería de flujos de datos para el análisis de clics en un sitio web / A model based on data streams mining to clickstream analysis in a websitespa
dc.typeTrabajo de grado - Maestríaspa
dc.type.coarhttp://purl.org/coar/resource_type/c_bdccspa
dc.type.coarversionhttp://purl.org/coar/version/c_ab4af688f83e57aaspa
dc.type.contentTextspa
dc.type.driverinfo:eu-repo/semantics/masterThesisspa
dc.type.redcolhttp://purl.org/redcol/resource_type/TMspa
dc.type.versioninfo:eu-repo/semantics/acceptedVersionspa
oaire.accessrightshttp://purl.org/coar/access_right/c_abf2spa

Archivos

Bloque original

Mostrando 1 - 1 de 1
Cargando...
Miniatura
Nombre:
299675.2010.pdf
Tamaño:
10.57 MB
Formato:
Adobe Portable Document Format