El metadato automático (o extracción de metadato) es un método de creación que permite dar de alta objetos en Anjana Data Platform a partir del descubrimiento automático de las estructuras existentes en un sistema origen. En lugar de introducir el metadato manualmente, la plataforma se conecta al origen, descubre sus estructuras (tablas, campos, vistas, informes, etc.) y genera en Anjana las entidades o relaciones correspondientes correspondientes. Está disponible para los usuarios que dispongan del permiso específico de importación.
Cómo funciona
El metadato automático se sustenta en la integración de Anjana Data Platform con las distintas tecnologías del ecosistema de datos mediante un Plugin, el componente que conecta la plataforma con una tecnología concreta (Oracle, SQL Server, AWS S3, Denodo, BigQuery, Power Bi, Tableau, etc.). Habitualmente se trata de un Tot Plugin, la familia de plugins que mantiene Anjana Data SL.
-
Concepto y capacidades de los plugins: Plugins
-
Catálogo y comportamiento de los Tot Plugins: Tot Plugins
La invocación de un plugin se realiza mediante la selección de una tripleta —una terna de infraestructura, tecnología y zona— que indica a la plataforma qué funcionalidad debe ejecutar y dónde. Cada tripleta resuelve una conexión concreta con la tecnología origen. En el caso del metadato automático, la tripleta seleccionada habilita la funcionalidad de extracción de metadatos y condiciona las funcionalidades adicionales que dispondrá el objeto (muestra de datos, gestión de permisos de acceso, etc).
La definición y configuración de las tripletas, así como los errores asociados a su uso (por ejemplo, «No existe un plugin para extract»), se documentan en la página Tripletas.
Requisitos previos
-
El usuario debe contar con el permiso específico para la creación mediante metadato automático. Permisos
-
La plantilla del subtipo que se desea importar debe tener configurados los atributos infraestructura, tecnología, zona y path.
-
El Plugin correspondiente debe estar desplegado, levantado y su tripleta configurada para la funcionalidad de extracción.
Proceso de creación
-
En el Wizard de creación, seleccionar el subtipo y el método metadato automático.
-
Proporcionar los atributos de conexión al origen (a través de la tripleta correspondiente) y la unidad organizativa en la que se darán de alta los objetos.
-
Seleccionar, de entre las estructuras disponibles descubiertas en el origen, aquellas que se desean dar de alta en Anjana.
-
Elegir la opción de crear los objetos: se genera un Trabajo de importación con un nombre autogenerado y editable.
-
Al confirmar, se muestra un enlace para navegar al detalle del Trabajo, desde el que se sigue el estado y el resultado de la importación.
El seguimiento de la importación se realiza desde el módulo de Trabajos. Se detalla en la página Trabajos.
Anjana Data Platform es capaz de recuperar el metadato de diferentes tecnologías y plataformas de datos, cuyo conjunto se amplía de forma continua según el roadmap de producto. Para conocer las tecnologías disponibles en cada versión, conviene consultar la documentación técnica correspondiente.
Estado importado
Tras la importación con metadato automático, el objeto queda en estado Importado, similar a Borrador pero con la particularidad de que algún atributo de la PK puede quedar sin completar si no se ha podido recuperar del sistema origen.
-
En este estado es posible editar el nombre (atributo
name) del objeto (sin necesidad de hacer uso de la funcionalidad de renombrado), con el fin de asignar un nombre lógico distinto del nombre físico recuperado del entorno de origen. -
En el caso de un dataset, para editar su nombre deben editarse primero los nombres de sus
dataset_fieldsy, a continuación, el del propio dataset. Debe hacerse sin tocar ningún otro atributo. -
Una vez que el usuario guarda el objeto por primera vez desde su formulario, el objeto pasa a estado Borrador y su nombre deja de ser editable.
Este apartado está dirigido principalmente a usuarios del Portal de Datos con permisos de creación mediante metadato automático —por ejemplo, Data Stewards y perfiles técnicos— responsables de incorporar activos descubiertos en los sistemas origen.