¿Qué es la replicación de bases de datos?

Mujer de negocios segura de sí misma con sus colegas y un portátil, hablando de replicación de bases de datos.

La replicación de bases de datos crea y mantiene varias copias de los datos para aumentar su accesibilidad y disponibilidad. El proceso suele consistir en copiar los datos de una base de datos de origen a una o varias bases de datos adicionales, garantizando al mismo tiempo que todos los datos sean idénticos en todas las ubicaciones.

¿Por qué es importante la replicación de bases de datos?

Disponer de una única fuente de datos supone tener un único punto de fallo, lo que puede poner en riesgo a una empresa. Si no se puede acceder a la base de datos o esta resulta dañada, se perderán los datos almacenados. Las copias de seguridad completas periódicas permiten recuperar los datos hasta el momento de la última copia de seguridad, pero los cambios realizados después de dicha copia pueden perderse. La replicación de bases de datos elimina este posible problema al mantener varias copias de la base de datos para garantizar la protección de los datos.

La replicación de bases de datos puede utilizarse para mantener copias regionales de datos seleccionados, como las listas de precios locales, de modo que las tiendas o instalaciones dispongan de autonomía en caso de que los sistemas de la sede central dejen de funcionar por cualquier motivo. Por el contrario, los datos generados a nivel regional, como los resultados de ventas, pueden replicarse en una base de datos central para obtener una visión global.

Casos de uso de la replicación de bases de datos

Estas son algunas de las ventajas que la replicación de datos puede aportar a las organizaciones:

Protección de datos a nivel local

Si se necesita una segunda copia de una base de datos en el mismo centro de datos, por ejemplo, para dar soporte a los usuarios que generan informes y para garantizar la protección de los datos frente a fallos de almacenamiento, se puede mantener una copia sincronizada. Cada confirmación se aplicará simultáneamente a ambas copias de la base de datos.

Distribución de los datos geográficos

En un entorno minorista, es posible que cada tienda necesite una copia del esquema de la base de datos maestra de productos. A medida que se realizan cambios en la copia maestra en la sede central, las bases de datos regionales reciben las actualizaciones de forma asíncrona, momentos después de que se haya actualizado la copia maestra.

Copias de seguridad físicas

Una copia de seguridad física de una base de datos comienza con una copia de seguridad completa en el sitio principal. El sitio de archivo debe estar situado en una ubicación remota lo suficientemente alejada como para evitar que un mismo desastre natural o un corte de suministro eléctrico afecte a ambas ubicaciones. Este sitio secundario mantiene la base de datos en espera en modo de recuperación, aplicando los archivos de registro de la base de datos archivados a la copia a medida que se van completando y se envían al sitio de espera.

Copias de seguridad lógicas

A diferencia de la copia de seguridad física, una copia de seguridad lógica está abierta y es accesible para los usuarios con acceso de solo lectura para funciones de generación de informes. Se pueden añadir índices adicionales para agilizar las consultas. A medida que se producen cambios en los archivos de registro de la base de datos maestra, estos se propagan automáticamente a los sitios secundarios.

Apoyo mutuo

La replicación de la base de datos se puede configurar de modo que dos servidores actúen como servidores de reserva el uno para el otro. En este caso, ambos servidores están configurados para tener capacidad para gestionar toda la carga de trabajo de producción. Si falla cualquiera de los servidores, el restante pasa a ser el servidor principal para la carga de trabajo combinada.

Replicación diferida

Esta configuración poco habitual cuenta con una réplica secundaria de una base de datos que espera una o dos horas antes de aplicar los cambios. El motivo es protegerse contra los errores humanos. Por ejemplo, un administrador podría eliminar accidentalmente las tablas equivocadas o aplicar un cambio masivo destinado a una base de datos de prueba en un sistema de producción. Esto se conoce como «corrupción lógica», y es posible evitarlo disponiendo de una copia diferida.

Replicación multimaster

En un escenario multimaster, cada base de datos es un par de las demás. A medida que se producen cambios en una base de datos, sus pares reciben el cambio exacto a través del software de replicación. En el caso de una actualización circular o de varias actualizaciones del mismo registro, se requiere un sistema basado en reglas para interceptar los cambios y aplicar únicamente aquel con la marca de tiempo más reciente, por ejemplo.

Ventajas de la replicación de bases de datos

A continuación se enumeran algunas de las principales razones para replicar una base de datos:

  • En caso de fallo de la red que afecte a un sistema central, las copias regionales de una base de datos permiten la autonomía local.
  • Disponer de varias copias de la base de datos puede ayudar a protegerse frente a desastres y amenazas cibernéticas dirigidas a un único sitio.
  • Si falla una unidad de disco, además del sistema de matriz redundante de discos independientes (RAID), la copia de la base de datos contará con sus propias matrices de discos.
  • Las copias diferidas de una base de datos pueden ayudar a protegerse contra los errores humanos. Algunos sistemas de bases de datos han incorporado una función de rebobinado para este fin.

Plataforma de IA y replicación de Actian Analytics

La plataforma Actian Analytics AI ofrece una experiencia unificada para la captación, transformación, análisis y almacenamiento de datos. La replicación de bases de datos es compatible con el bot de captura de datos modificados (Change Data Capture) de las bases de datos Actian Ingres y Actian Analytics Engine .

Preguntas frecuentes

La replicación de bases de datos crea copias activas de los datos en varias bases de datos para mejorar la disponibilidad y la escalabilidad de lectura. Las copias de seguridad son copias de un momento concreto que se utilizan para la recuperación. La replicación permite la continuidad casi en tiempo real y el acceso local; las copias de seguridad sirven para la conservación a largo plazo y como puntos de restauración para la recuperación ante desastres.

 

La replicación síncrona garantiza que las confirmaciones se guarden en las réplicas antes de devolver un resultado satisfactorio (durabilidad fuerte), pero aumenta la latencia de las transacciones. La replicación asíncrona reduce la latencia de escritura y la carga de red, pero puede provocar la pérdida de transacciones recientes en caso de fallo del servidor principal (RPO más alto). Elige la opción adecuada en función del RPO/RTO requerido y de las características de la red.

Las réplicas en diferentes racks, centros de datos o regiones proporcionan destinos de conmutación por error, permiten una rápida promoción de roles y mantienen la autonomía local durante las particiones de red. La replicación reduce el tiempo de recuperación (RTO) y puede minimizar la pérdida potencial de datos (RPO) cuando se configura adecuadamente.

Tenga en cuenta el ancho de banda de replicación, la latencia y el rendimiento transaccional máximo. Utilice la captura de datos modificados o el envío incremental para reducir la carga, filtre o elimine los conjuntos de datos replicados siempre que sea posible, y supervise el retraso de replicación para garantizar que los consumidores reciban los datos a tiempo.

Utilice una replicación que preserve la atomicidad transaccional (CDC basada en registros, envío de WAL o transmisión con reconocimiento de transacciones). Coordine los cambios en el esquema, aplique las transacciones en orden y valide la coherencia mediante sumas de comprobación o tareas de conciliación periódicas.

Cifre los datos en tránsito y en reposo, aplique controles de acceso basados en roles, audite la actividad de replicación y asegúrese de que las ubicaciones de las réplicas cumplan con los requisitos normativos y de residencia de datos. Oculte o excluya los campos confidenciales de las réplicas utilizadas para la elaboración de informes o el desarrollo.