UIMA - UIMA

UIMA ( / j u i m ə / yoo- EE -mə ), abreviatura de no estructurados Arquitectura de Información de Gestión , es un estándar OASIS de análisis de contenido , desarrollados originalmente en IBM . Proporciona una arquitectura de software de componentes para el desarrollo, descubrimiento, composición e implementación de análisis multimodales para el análisis de información no estructurada y la integración con tecnologías de búsqueda .

Estructura

La arquitectura UIMA se puede pensar en cuatro dimensiones:

  1. Especifica las interfaces de los componentes en una canalización de análisis .
  2. Describe un conjunto de patrones de diseño .
  3. Sugiere dos representaciones de datos: una representación en memoria de anotaciones para análisis de alto rendimiento y una representación XML de anotaciones para integración con servicios web remotos.
  4. Sugiere roles de desarrollo que permiten que las herramientas sean utilizadas por usuarios con diversas habilidades.

Implementaciones y usos

Apache UIMA
Apache UIMA logo.svg
Desarrollador (es) IBM , Apache Software Foundation (desde octubre de 2006)
Lanzamiento estable
3.1.1 / 8 de noviembre de 2019 ; Hace 17 meses  ( 08-11-2019 )
Repositorio Edita esto en Wikidata
Escrito en Java con habilitación de C ++
Sistema operativo multiplataforma
Tipo minería de texto , extracción de información
Licencia Licencia Apache 2.0
Sitio web uima .apache .org

Apache UIMA , una implementación de referencia de UIMA, es mantenida por Apache Software Foundation .

UIMA se utiliza en varios proyectos de software:

  • IBM Research 's Watson utiliza UIMA para el análisis de los datos no estructurados .
  • El sistema de extracción de conocimientos y análisis de textos clínicos ( Apache cTAKES ) es un sistema basado en UIMA para la extracción de información de registros médicos.
  • DKPro Core es una colección de componentes UIMA reutilizables para el procesamiento de lenguaje natural de uso general.

Ver también

Referencias

enlaces externos