Ir al contenido

Documat


Evaluación de la Extracción de Entidades Nombradas de OpenCalais en castellano

  • Autores: Raquel Toribio, Paloma Martínez Fernández Árbol académico, César de Pablo Sánchez
  • Localización: Procesamiento del lenguaje natural, ISSN 1135-5948, Nº. 45, 2010, págs. 287-290
  • Idioma: español
  • Títulos paralelos:
    • Evaluation of Named Entity Recognition in Spanish with OpenCalais
  • Enlaces
  • Resumen
    • español

      En los últimos años se han popularizado herramientas de Extracción de Información comerciales dentro del ecosistema de servicios de la Web Semántica. OpenCalais ofrece actualmente reconocimiento y categorización de Entidades Nombradas en castellano de fácil integración en aplicaciones de PLN. Hemos evaluado esta herramienta de anotación de entidades en el corpus de noticias CoNLL 2002. OpenCalais obtiene valores de precisión aceptables en las principales clases (persona, lugares y organización). Sin embargo, en comparación con los prototipos de investigación en castellano puede mejorar la cobertura y el tratamiento de la ambigüedad.

    • English

      The Semantic Web ecosystem has seen the growing popularity of commercial Information Extraction services. Among them, OpenCalais provides Named Entity Recognition and Classification in Spanish. We have evaluated this service in the CONLL 2002 news corpus. The precision results are good enough for the development of applications that use the main classes (person, location and organization). However, recall and the treatment of ambiguous entities could be improved to be in pair with research prototypes.

  • Referencias bibliográficas
    • Carreras, X., L. Márquez, y L. Padró, 2002. Named Entity Extraction using AdaBoost. Proceedings de CoNLL-2002 (pp. 167-170), Taipei, Taiwan.
    • Ferrández, O, A. Toral, y R. Muñoz. 2006. Fine Tuning Features and Post-processing Rules to Improve Named Entity Recognition. NLDB 2006 (pp....
    • Florian R. 2002. Named Entity Recognition as a House of Cards: Classifier Stacking. Proceedings of CoNLL-2002 (pp. 175-178), Taipei, Taiwan,...
    • Sang, E. T. 2002. Introduction to the CoNLL- 2002 Shared Task: Language-Independent Named Entity Recognition. Proceedings of CoNLL-2002 (pp....

Fundación Dialnet

Mi Documat

Opciones de artículo

Opciones de compartir

Opciones de entorno