APLICACIÓN DE TÉCNICAS DE APRENDIZAJE NO SUPERVISADO PARA LA AGRUPACIÓN DE TRAZAS EN EL DOMINIO DE MINERÍA DE PROCESOS (APPLICATION OF UNSUPERVISED LEARNING TECHNIQUES FOR CLUSTERING TRACES IN THE PROCESS MINING DOMAIN)

Loading...
Thumbnail Image

Authors

Journal Title

Journal ISSN

Volume Title

Publisher

Abstract

Resumen La mineria de procesos tiene como objetivo el descubrir, monitorear y mejorar los modelos de procesos de una organizacion a traves de la extraccion del conocimiento a partir de los datos contenidos en los registros de eventos. En algunos casos, dentro de la tarea de descubrimiento de modelos de procesos, el modelo minado puede ser dificil de comprender e interpretar debido a la diversidad de comportamientos identificados. En este articulo se presenta un enfoque basado en tecnicas de aprendizaje no supervisado para la agrupacion de trazas para generar modelos mas simples y compresibles. Los algoritmos implementados para la agrupacion son K-medias , jerarquico aglomerativo y agrupamiento espacial basado en densidad de aplicaciones con ruido (DBSCAN). En nuestra propuesta se realiza la sintonizacion o seleccion de los mejores parametros para cada algoritmo de aprendizaje no supervisado, usando la metrica Silhouette para mejorar el agrupamiento de trazas, con lo cual se pueden descubrir modelos de procesos simples con una aptitud media aceptable. Para la validacion de nuestra propuesta, las pruebas realizadas se centraron en un caso de estudio del sistema de facturacion del hospital AMC, obteniendo al algoritmo jerarquico con mejor desempeno y obtenido una aptitud media de 0.7876. Palabras Claves: Agrupamiento de trazas, mineria de procesos, modelos espagueti, registro de eventos. Abstract Process mining techniques aim to discover, monitor and improve the processes performed by an organization through the extraction of knowledge from the data contained in the event logs. In some cases, within the task of discovery of business process models discovered can be difficult to understand and interpret because of the large number of behaviors identified. This article presents an approach based on unsupervised learning techniques for clustering trace to generate simpler and more compressible models. The algorithms implemented for clustering are K-means , hierarchical agglomerative and density-based spatial clustering of applications with noise (DBSCAN) algorithms. In our proposal, the best parameters for each unsupervised learning algorithm are tuned or selected, using the Silhouette metric to improve the clustering of traces, with which models of simple processes with an acceptable aptitude can be discovered. For the validation of our proposal, the tests performed focused on a case study of the AMC hospital billing system, obtaining the hierarchical algorithm with the best performance and obtained an average aptitude of 0.7876. Keywords : Clustering trace, event log, process mining, spaghetti models.

Description

Citation

Endorsement

Review

Supplemented By

Referenced By

Creative Commons license

Except where otherwise noted, this item's license is described as Acceso restringido / Suscripción (Metadatos de producción científica)