APLICACIÓN DE TÉCNICAS DE APRENDIZAJE NO SUPERVISADO PARA LA AGRUPACIÓN DE TRAZAS EN EL DOMINIO DE MINERÍA DE PROCESOS (APPLICATION OF UNSUPERVISED LEARNING TECHNIQUES FOR CLUSTERING TRACES IN THE PROCESS MINING DOMAIN)
Abstract
Resumen La mineria de procesos tiene como objetivo el descubrir, monitorear y mejorar los modelos de procesos de una organizacion a traves de la extraccion del conocimiento a partir de los datos contenidos en los registros de eventos. En algunos casos, dentro de la tarea de descubrimiento de modelos de procesos, el modelo minado puede ser dificil de comprender e interpretar debido a la diversidad de comportamientos identificados. En este articulo se presenta un enfoque basado en tecnicas de aprendizaje no supervisado para la agrupacion de trazas para generar modelos mas simples y compresibles. Los algoritmos implementados para la agrupacion son K-medias , jerarquico aglomerativo y agrupamiento espacial basado en densidad de aplicaciones con ruido (DBSCAN). En nuestra propuesta se realiza la sintonizacion o seleccion de los mejores parametros para cada algoritmo de aprendizaje no supervisado, usando la metrica Silhouette para mejorar el agrupamiento de trazas, con lo cual se pueden descubrir modelos de procesos simples con una aptitud media aceptable. Para la validacion de nuestra propuesta, las pruebas realizadas se centraron en un caso de estudio del sistema de facturacion del hospital AMC, obteniendo al algoritmo jerarquico con mejor desempeno y obtenido una aptitud media de 0.7876. Palabras Claves: Agrupamiento de trazas, mineria de procesos, modelos espagueti, registro de eventos. Abstract Process mining techniques aim to discover, monitor and improve the processes performed by an organization through the extraction of knowledge from the data contained in the event logs. In some cases, within the task of discovery of business process models discovered can be difficult to understand and interpret because of the large number of behaviors identified. This article presents an approach based on unsupervised learning techniques for clustering trace to generate simpler and more compressible models. The algorithms implemented for clustering are K-means , hierarchical agglomerative and density-based spatial clustering of applications with noise (DBSCAN) algorithms. In our proposal, the best parameters for each unsupervised learning algorithm are tuned or selected, using the Silhouette metric to improve the clustering of traces, with which models of simple processes with an acceptable aptitude can be discovered. For the validation of our proposal, the tests performed focused on a case study of the AMC hospital billing system, obtaining the hierarchical algorithm with the best performance and obtained an average aptitude of 0.7876. Keywords : Clustering trace, event log, process mining, spaghetti models.
Description
Keywords
Citation
Collections
Endorsement
Review
Supplemented By
Referenced By
Creative Commons license
Except where otherwise noted, this item's license is described as Acceso restringido / Suscripción (Metadatos de producción científica)
