Publication:
Evaluación de la extracción de entidades nombradas de OpenCalais en castellano

Loading...
Thumbnail Image
Identifiers
ISSN: 1989-7553 (online)
ISSN: 1135-5948 (print)
Publication date
2010-09
Defense date
Advisors
Tutors
Journal Title
Journal ISSN
Volume Title
Publisher
Sociedad Española para el Procesamiento del Lenguaje Natural
Impact
Google Scholar
Export
Research Projects
Organizational Units
Journal Issue
Abstract
En los últimos años se han popularizado herramientas de Extracción de Información comerciales dentro del ecosistema de servicios de la Web Semántica. OpenCalais ofrece actualmente reconocimiento y categorización de Entidades Nombradas en castellano de fácil integración en aplicaciones de PLN. Hemos evaluado esta herramienta de anotación de entidades en el corpus de noticias CoNLL 2002. OpenCalais obtiene valores de precisión aceptables en las principales clases (persona, lugares y organización). Sin embargo, en comparación con los prototipos de investigación en castellano puede mejorar la cobertura y el tratamiento de la ambigüedad.
The Semantic Web ecosystem has seen the growing popularity of commercial Information Extraction services. Among them, OpenCalais provides Named Entity Recognition and Classification in Spanish. We have evaluated this service in the CONLL 2002 news corpus. The precision results are good enough for the development of applications that use the main classes (person, location and organization). However, recall and the treatment of ambiguous entities could be improved to be in pair with research prototypes.
Description
Keywords
Reconocimiento y Clasificación de Entidades Nombradas, Evaluación, Extracción de información, Web semántica, Castellano, Named Entity Recognition and Classification, Evaluation, Information extraction, Spanish
Bibliographic citation
Procesamiento del Lenguaje Natural 45 (2010) pp. 287-290