27 de octubre de 2025

¿Qué es la conmutación por error? Cómo funciona y por qué es importante para la BCDR

Por Adam Marget
Continuidad del negocioEnrutadores Datto Edge

Cuando ocurre un desastre —ya sea un ataque de ransomware, un corte de energía o una actualización fallida—, las empresas no pueden permitirse el lujo de sufrir tiempo de inactividad. Ahí es donde entra en juego la conmutación por error. Como capa de ejecución de una estrategia de continuidad de negocios y recuperación ante desastres (BCDR), la conmutación por error garantiza que las operaciones continúen incluso cuando los sistemas primarios se caen. En términos simples, la conmutación por error hace posible la verdadera resiliencia. Desvía automáticamente las cargas de trabajo a sistemas o entornos de respaldo para que sus aplicaciones, servidores y redes sigan estando disponibles.

En esta guía, explicaremos qué es la conmutación por error, cómo funciona, cuándo se utiliza y por qué es una capacidad esencial para lograr la continuidad.

¿Qué es la conmutación por error?

La conmutación por error se refiere a la transferencia automática y sin interrupciones de las operaciones de un sistema que ha fallado o se ha visto comprometido a un sistema de respaldo. El objetivo es mantener un tiempo de actividad continuo y evitar interrupciones en las funciones críticas para el negocio. Piense en la conmutación por error como su red de seguridad: cuando un servidor o centro de datos se cae, otro toma el relevo al instante. No solo restaura los sistemas, sino que también garantiza la continuidad sin intervención manual, ya que está integrada en la arquitectura de sistemas de alta disponibilidad que ayudan a las empresas a mantener la productividad y el cumplimiento normativo bajo presión.

La conmutación por error desempeña un papel fundamental en un ecosistema de resiliencia más amplio que incluye:

  • Redundancia: Duplicación de sistemas o componentes clave para eliminar los puntos únicos de falla.
  • Replicación: Sincronización continua de datos entre los sistemas primario y secundario.
  • Equilibrio de carga: Distribución de las cargas de trabajo entre varios sistemas para optimizar el rendimiento.
  • Conmutación: Una transferencia planificada entre sistemas, normalmente con fines de mantenimiento, a diferencia de la conmutación por fallo, que ocurre automáticamente y sin previo aviso.

La conmutación por error garantiza que, si algo sale mal, sus sistemas no se detengan, sino que se recuperen de forma instantánea y transparente para los usuarios finales.

¿Por qué es importante la conmutación por error?

En el panorama digital actual, el tiempo de inactividad es costoso, tanto desde el punto de vista financiero como de reputación. La conmutación por error es fundamental porque actúa como la capa de ejecución de la continuidad del negocio, llevando a cabo automáticamente la recuperación cuando se producen interrupciones. Según estudios del sector, incluso unos pocos minutos de inactividad pueden costar miles de dólares en pérdida de productividad, ingresos y confianza de los clientes. La conmutación por error mitiga este riesgo al transformar la recuperación de un proceso reactivo en una respuesta proactiva y automatizada.

Sin conmutación por error, sus planes de continuidad y recuperación ante desastres son solo teóricos. Con ella, usted puede:

  • Evita el tiempo de inactividad y la pérdida de datos a causa de fallas inesperadas.
  • Mantener la resiliencia operativa, incluso durante interrupciones a gran escala.
  • Cumplir con los objetivos de nivel de servicio y de recuperación, como los objetivos de tiempo de recuperación (RTO).
  • Fomentar la confianza y la satisfacción de los clientes mediante un servicio ininterrumpido.

La conmutación por error es lo que convierte la planificación de la continuidad del negocio en la ejecución de la continuidad del negocio.

Escenarios comunes de conmutación por error

La conmutación por error se utiliza en una amplia variedad de situaciones reales, desde desastres naturales hasta actualizaciones del sistema. A continuación se presentan los escenarios más comunes en los que la conmutación por error mantiene a las empresas en funcionamiento.

Desastres naturales o daños físicos

Las inundaciones, los incendios o los terremotos pueden destruir el hardware o las instalaciones locales. En estas situaciones, la conmutación por error basada en la nube transfiere automáticamente las cargas de trabajo a entornos seguros fuera del sitio para que las operaciones puedan reanudarse rápidamente. Esta rápida transición mantiene a los equipos conectados, evita la pérdida de datos y permite que los servicios esenciales —como la atención al cliente o el procesamiento de transacciones— continúen sin interrupciones.

Fallo de hardware, software o aplicación

Los servidores se bloquean, las aplicaciones se cuelgan o las bases de datos se dañan. Los sistemas de conmutación por error detectan estas interrupciones y redirigen la actividad a hardware redundante o entornos replicados, a menudo en cuestión de segundos. Esto no solo minimiza el tiempo de inactividad, sino que también reduce la necesidad de realizar una resolución de problemas manual durante los primeros momentos críticos de una falla.

Cortes de red o de energía

Una falla del proveedor de servicios de Internet (ISP) o un corte de energía local pueden interrumpir el acceso a sus sistemas. La conmutación por error garantiza la continuidad mediante conexiones redundantes o centros de datos alternativos. Gracias al enrutamiento automatizado y a las rutas de red de respaldo, los empleados y los clientes pueden seguir accediendo a sus aplicaciones, incluso si falla una conexión.

Ransomware o ciberataques

Cuando el malware bloquea o cifra los datos, la conmutación por error le permite poner en marcha sistemas limpios y aislados a partir de copias de seguridad verificadas, lo que minimiza el impacto en el negocio mientras los equipos de TI solucionan la amenaza. Esta separación entre los entornos infectados y los de copia de seguridad es crucial para detener la propagación del ransomware y mantener la integridad operativa.

Mantenimiento programado o actualizaciones

Incluso los eventos programados pueden provocar tiempos de inactividad. La conmutación por error permite realizar un mantenimiento sin interrupciones, lo que permite que las actualizaciones o los parches se apliquen en los sistemas principales mientras los usuarios permanecen conectados a través de los sistemas de respaldo. Esto significa que los equipos pueden realizar actualizaciones o aplicar parches de seguridad sin desconectar los sistemas, lo que reduce los intervalos de mantenimiento y mejora la productividad.

Cómo funciona la conmutación por error

El concepto de conmutación por error es sencillo, pero la tecnología que lo sustenta es sofisticada. Un sistema de conmutación por error supervisa continuamente el estado de los sistemas primarios a través de una conexión de «latido», una señal constante que confirma que el sistema está activo y operativo. Si ese latido se interrumpe, el proceso de conmutación por error se inicia automáticamente. El sistema de respaldo asume el control, redirige las operaciones y garantiza que los usuarios experimenten una interrupción mínima o nula. Los sistemas de conmutación por error se pueden configurar de diferentes maneras dependiendo del tamaño de la empresa, la tolerancia al costo y los requisitos de tiempo de actividad.

Veamos algunas configuraciones comunes:

Configuraciones activo-activo frente a activo-pasivo

En estas configuraciones, el diseño del sistema determina si los servidores de respaldo comparten la carga de manera continua o permanecen en modo de espera hasta que se produce una falla.

  • Activo-activo: Ambos sistemas funcionan simultáneamente y comparten la carga de trabajo. Si uno falla, el otro se hace cargo al instante del 100 % de las operaciones. Esta configuración garantiza un tiempo de inactividad prácticamente nulo.
  • Activo-pasivo: El sistema secundario permanece en espera hasta que se produce una falla, momento en el que se activa y asume el control. Esta opción es económica, pero puede implicar un ligero retraso en la recuperación.

Conmutación por error en caliente frente a conmutación por error en frío

Además de la actividad del sistema, los entornos de conmutación por error también se diferencian por su nivel de preparación, es decir, la rapidez con la que pueden asumir las operaciones cuando sea necesario.

  • Conmutación en caliente: El entorno de respaldo está totalmente operativo y sincronizado, lo que permite una recuperación instantánea.
  • Conmutación en frío: La copia de seguridad permanece fuera de línea hasta que se inicia o se restaura manualmente, lo que implica un tiempo de inactividad más prolongado, pero menores costos.

Clústeres de conmutación por error

La agrupación en clústeres de conmutación por error consiste en conectar varios servidores o sistemas para que funcionen como un entorno unificado y de alta disponibilidad. Si un nodo falla, otro nodo del clúster asume automáticamente sus responsabilidades, lo que garantiza la continuidad del servicio sin interrupciones. Esta configuración elimina los puntos únicos de falla y equilibra dinámicamente las cargas de trabajo entre los nodos, lo que la hace ideal para grandes empresas y aplicaciones de misión crítica.

Cómo la conmutación por error respalda la BCDR

La conmutación automática es un pilar fundamental de cualquier estrategia de BCDR. Sirve de puente entre la planificación y la ejecución, garantizando que los objetivos de recuperación se cumplan realmente cuando ocurra un desastre.

Reduce el tiempo de inactividad para cumplir con los objetivos de RTO: La conmutación automática ayuda a las empresas a alcanzar sus objetivos de RTO —el tiempo máximo aceptable durante el cual una aplicación o un sistema puede permanecer inactivo después de un incidente—. Al permitir una rápida recuperación del sistema, la conmutación automática garantiza que las empresas cumplan o incluso superen estos objetivos. Esta automatización ayuda a las organizaciones a cumplir con los compromisos de los SLA y a evitar los altos costos asociados con las interrupciones prolongadas.

Utiliza la calculadora de RTO de Datto para determinar los objetivos de recuperación óptimos para tu organización.

Desempeña un papel clave en las pruebas de recuperación ante desastres: la conmutación por error permite a los equipos probar los planes de recuperación de manera segura y sin interrumpir el servicio. Las pruebas periódicas ayudan a confirmar que los sistemas se conmutan por error como se espera y que los tiempos de recuperación se ajustan a las necesidades del negocio. Al automatizar las pruebas de conmutación por error, los equipos pueden validar los flujos de trabajo de recuperación en condiciones reales sin interrumpir los sistemas de producción.

Obtén más información en la guía de pruebas de recuperación ante desastres de Datto.

Permite la continuidad de las operaciones: ya sea que se trate de un ciberataque o de una actualización fallida, la conmutación automática garantiza que los usuarios permanezcan en línea, sean productivos y estén conectados a los sistemas esenciales. Es lo que mantiene en funcionamiento el servicio al cliente, las ventas y las operaciones mientras el departamento de TI resuelve la causa raíz. Esta continuidad protege las fuentes de ingresos, la satisfacción del cliente y la confianza en la marca, incluso durante interrupciones de gran impacto.

Qué hay que tener en cuenta con los sistemas de conmutación por error

El diseño de un sistema de conmutación por error requiere una planificación cuidadosa. Tenga en cuenta estos aspectos clave al desarrollar o mejorar su estrategia de BCDR:

  • Objetivos de RTO, automatización y escalabilidad: Asegúrate de que tu solución de conmutación por error pueda adaptarse a medida que crece tu negocio y cumpla con tu tiempo de recuperación objetivo gracias a la automatización.
  • Conmutación por error local, en la nube o híbrida:
    • La conmutación por error local ofrece los tiempos de recuperación más rápidos, pero puede ser vulnerable a desastres que afecten a todo el sitio.
    • La conmutación por error en la nube ofrece resiliencia geográfica y accesibilidad.
    • La conmutación por error híbrida combina lo mejor de ambos mundos: una recuperación local rápida y una redundancia segura fuera del sitio.
  • Sistemas en clúster frente a sistemas independientes: Los sistemas en clúster ofrecen mayor disponibilidad gracias a la redundancia, mientras que los sistemas independientes pueden ser más sencillos, pero menos resistentes.

Inicie la conmutación por error y recupérese automáticamente con Datto BCDR

La conmutación por error no es opcional, es esencial. Como pilar fundamental de una estrategia eficaz de BCDR, transforma los planes de recuperación ante desastres en procesos automatizados y aplicables.

Las soluciones BCDR de Datto permiten la conmutación por error en la nube híbrida y la virtualización instantánea, lo que brinda a los proveedores de servicios gestionados (MSP) y a los profesionales de TI la capacidad de restaurar sistemas críticos en segundos, no en horas. Ya sea a través de la virtualización local o de un entorno seguro en la nube, Datto ofrece una recuperación resiliente que mantiene tu negocio en funcionamiento, pase lo que pase. Obtén más información sobre cómo las soluciones BCDR de Datto protegen a tus clientes y sus datos con una confiabilidad líder en la industria.

Siguientes lecturas recomendadas