Saltar al contenido principal
Versión: v2 ⚡

Glosario de integración de datos

Este glosario reúne algunos de los conceptos y términos fundamentales que se usan al hablar de integración de datos y de automatización de flujos de trabajo.

No necesitas saber qué significan estas palabras antes de leer nuestra documentación para usar OpenFn. Pero algunas de las tareas más importantes del recorrido con OpenFn dan por hecho que entiendes, al menos a grandes rasgos, cada uno de estos términos.

Este glosario no es específico de OpenFn. El resto de la documentación y la página de conceptos clave te ayudan a hacerte una idea de las partes de OpenFn, de cómo las llamamos y por qué. Este glosario, en cambio, es un requisito previo a todo eso, pensado para quienes no tienen experiencia en este ámbito.

¿Falta algo?

Si encontraste una palabra, una expresión o un concepto que crees que falta en esta página, abre un issue en OpenFn/docs, sugiere un cambio en esta página o pregunta en la comunidad

API​

API es la sigla de "application programming interface" (interfaz de programación de aplicaciones). Es la parte de un software (la aplicación) que decidió hacerse visible (la interfaz) a usuarios externos a la propia aplicación. Y lo hace de forma programática, es decir, de una forma que permite a los desarrolladores de otras aplicaciones o sistemas de datos usarla siempre de la misma manera.

Protocolo de API​

No hay una regla fija sobre cómo se desarrolla una API, pero con el tiempo han surgido estándares que hacen que la mayoría de las aplicaciones usen uno de unos pocos formatos. Así, a un usuario nuevo le resulta más sencillo interactuar con la API de la plataforma X. Eso es un protocolo de API. Algunos de los nombres más conocidos son REST, SOAP, JSON y GraphQL. En lugar de reinventar la rueda, aquí tienes una buena introducción a en qué se diferencian los protocolos, sus formatos de datos y por qué todo eso importa.

Base de datos​

Casi cualquier colección organizada de datos puede llamarse base de datos. Si tiene una estructura con la que hacer referencia a todo lo que almacena, y lo que almacena son datos, entonces es una base de datos.

Integración de datos​

El proceso de combinar datos de distintas fuentes en una vista centralizada. La integración de datos es una forma de lograr la automatización de flujos de trabajo. Sus tareas pueden simplificarse, automatizarse y gestionarse con una herramienta de automatización de flujos de trabajo.

Fuente de datos​

Una fuente de datos es una aplicación, una base de datos o una tabla que proporciona datos a otra plataforma. Nada es siempre una fuente de datos. Por ejemplo, Google Sheets puede ser una fuente de datos, pero también puede obtener datos de otras fuentes (cargas individuales de archivos CSV o datos que los usuarios ingresan a mano). Solo la llamamos fuente cuando está proporcionando datos a otro lugar. En el tiempo, las fuentes de datos son el punto de partida de cualquier integración.

Sistema de datos​

A veces se confunde la diferencia entre una base de datos, una fuente de datos, una aplicación y un sistema de datos. Un sistema de datos es un conjunto más complejo de esas otras cosas, normalmente uno que permite a un usuario interactuar más fácilmente con todos los datos a los que debería tener acceso. El sistema de datos suele servir como punto de entrada a la multitud de bases de datos, aplicaciones, tablas, etc., que de otro modo el usuario tendría que buscar en 12 lugares distintos.

Cifrado​

Hoy en día, la seguridad lo es todo. El cifrado es el proceso de tomar algo que cualquiera puede leer y hacer que solo puedan leerlo las personas que queremos. OpenFn garantiza que tus datos estén cifrados en todo momento mientras están en nuestra plataforma. Para saber más sobre los distintos tipos de cifrado, puedes consultar aquí.

Sistema de archivos​

Un sistema de archivos es a los archivos lo que un sistema de datos es a los datos. Organiza tus archivos de forma que te resulte fácil recuperarlos de manera estandarizada (piensa en el sistema de archivos de la computadora de tu casa, con sus rutas de archivo). Los sistemas de archivos también existen en otros contextos, y a veces necesitas acceder a ellos para recuperar un archivo (un documento de Word, un CSV o un archivo de texto plano, entre otros, según tu caso de uso). La única diferencia real entre los sistemas de archivos y los sistemas de datos o las bases de datos es el tipo de información que almacenan: datos frente a archivos.

ETL​

ETL son las siglas en inglés de "extract, transform, and load" (extraer, transformar y cargar). A menudo se consideran las tres partes que componen una integración de datos. Primero, extraemos (enviamos o recuperamos datos de una fuente de datos). Después, transformamos (hacemos los cambios necesarios en los datos para que el sistema o la aplicación de destino los acepte). Por último, cargamos (los enviamos al destino).

Plataforma de integración​

Una plataforma de integración (por ejemplo, OpenFn) es una aplicación (o un conjunto de aplicaciones) que ayuda a las organizaciones a configurar, ejecutar y mantener o gestionar las integraciones entre todos sus sistemas.

iPaaS​

Puede que también veas la sigla "iPaaS". Significa "integration platform as a service" (plataforma de integración como servicio) y es un tipo de "software como servicio" (o "SaaS"). El SaaS es un modelo de compra de software en el que el software se paga solo a medida que se usa (a menudo mes a mes), en lugar de comprarse por adelantado o regalarse.

Metadatos​

Son datos que nos dicen algo sobre nuestros datos. En una tabla, por ejemplo, son los nombres de las columnas, el número de filas, etc. Los metadatos suelen salir en las conversaciones sobre privacidad. Por ejemplo, los reguladores pueden querer asegurarse de que solo los metadatos pasen del Ministerio A al Ministerio B, y no la información de identificación personal (PII) de las propias personas.

Push, pull y streaming​

El push (envío) se produce cuando una acción en la fuente de datos hace que esta envíe datos al destino. El pull (recuperación) es lo contrario: el sistema de destino le pide los datos a la fuente a partir de alguna acción, en lugar de esperar a que la fuente los envíe por su cuenta. El streaming es algo distinto: se da cuando una fuente de datos envía datos a un sistema de destino de forma prácticamente constante.

Webhook​

Un webhook (también llamado web callback o API HTTP push, ¡gracias, SendGrid!) es una función de una aplicación que permite hacer push. Suele configurarse para avisar a una URL externa cuando ocurre un evento. Un administrador de sistemas podría crear un "webhook" que avise a una plataforma de integración cada vez que ocurra algún evento, para que la iPaaS empiece a ejecutar un workflow complejo.

Datos estructurados y no estructurados​

Los datos estructurados son datos que tienen metadatos. Los datos no estructurados tienen muy pocos metadatos (aunque probablemente conserven cosas como la fecha de creación o de actualización). Sin metadatos sobre su formato, es más difícil trabajar con los datos no estructurados mediante programación. Para hacer bien un ETL sobre datos no estructurados necesitamos otro tipo de reglas. Los datos estructurados son un punto de partida más fácil, porque sabemos qué esperar de una columna con nombre, tipo de dato, tamaño de campo, etc.

Flujo de trabajo​

El conjunto de instrucciones que determinan cómo resolver un problema o realizar una tarea. A menudo se divide en tareas más pequeñas e independientes.

Automatización de flujos de trabajo​

El uso de software para realizar tareas o un proceso de negocio de forma autónoma, de acuerdo con reglas de negocio predefinidas y sin necesidad de intervención humana.

Writeback​

Se refiere a que un sistema de destino haga un cambio en una fuente de datos. Cuando tu aplicación de destino recibe información de una fuente de datos y quiere hacer algo en la fuente como respuesta, eso es writeback.