Developing metrics to estimate the information quality of Wikipedia articles is an interesting and important research area. In this article, we propose, and analyze the feasibility, of a new quality metric based on the “external factual support” of an article. The rationale behind this metric is identified, a formal definition of the metric is presented and some implementation aspects are introduced. Preliminary results show the feasibility of our proposal and its potential to discriminate high quality versus low quality Wikipedia’s articles.

Carlos Velázquez, Leticia Cagnina, Marcelo Errecalde. Publicado en la revista digital SEPLN, volumen 58, año 2017, páginas 97 a 100.

Developing metrics to estimate the information quality of Wikipedia articles is an interesting and important research area. In this article, we review some of the main aspects to be considered when using quality metrics for Wikipedia and propose a new quality metric based on the “external support” of an article. The rationale behind this metric is identified, a definition of the metric is presented and some implementation aspects are described. Preliminary results show the feasibility of our proposal and its potential to discriminate high quality versus low quality Wikipedia’s articles.

Carlos G. Velázquez, Leticia C. Cagnina, Marcelo L. Errecalde. WOPATEC (Workshop de Procesamiento Automatizado de Textos y Corpus), Universidad Católica de Valparaíso, Viña del Mar, Chile. 2016.

Este artículo describe, brevemente, las tareas de investigación y desarrollo llevadas a cabo en la línea “Minería de Textos y de la Web”, en el marco del proyecto “Aprendizaje automático y toma de decisiones en sistemas inteligentes para la Web”. Aborda áreas vinculadas al Procesamiento del Lenguaje Natural, la Lingüística Computacional, la Minería de Textos y de la Web, y la recuperación de información, incluyendo representación de documentos y usuarios, medidas de calidad de la información, técnicas de extracción de información y algoritmos de categorización supervisados, semi-supervisados y no supervisados.

Leticia Cagnina, Edgardo Ferretti, M. Paula Villegas, M. José Garciarena Ucelay, Sergio Burdisso, Darío Funez, Carlos Velázquez, Marcelo Errecalde. WICC (Workshop de Investigadores en Ciencias de la Computación), Universidad Nacional de Entre Ríos, Argentina. 2013.

Clustering of short texts is an important research area because of its applicability in information retrieval and text mining. To this end, CLUDIPSO was proposed: a discrete Particle Swarm Optimization algorithm to cluster short texts. Initial results showed good performance in small collections, but later work showed drawbacks with larger collections. This paper presents a hybridization of CLUDIPSO that provides information in the initial cycles of the algorithm to avoid a random search and speed up convergence, using a pre-clustering obtained with the Expectation-Maximization method. The hybrid version shows a significant improvement over the original.

Carlos Velázquez, Leticia Cagnina, Marcelo Errecalde. CACIC (Congreso Argentino de Ciencias de la Computación), UNS, Bahía Blanca, Buenos Aires, Argentina. Expositor. Exposición premiada. 2012. Presentado también por Marcelo Errecalde en Graz, Austria, 2014.

En este artículo se describen, en forma resumida, los trabajos de investigación y desarrollo llevados a cabo en la línea “Sistemas Inteligentes”, en las áreas de Text Mining, Web Mining y Web Intelligence, abordando tareas como: clustering de textos cortos multilingües, categorización semántica de textos, medidas de calidad de la información en la Web, detección de plagio y atribución de autoría, minería de opinión y sentimientos, integración de agentes y técnicas de minería de textos, y uso de arquitecturas cognitivas para agentes web, en particular aquellas basadas en lógica, razonamiento argumentativo y teoría de decisión cualitativa.

Marcelo Errecalde, Edgardo Ferretti, Diego Ingaramo, María Rosas, Leticia Cagnina, Darío Funez, Patricia Roggero, Carlos Velázquez. WICC (Workshop de Investigadores en Ciencias de la Computación), UNM, Misiones, Argentina. 2012.