Continuidad

¿Qué es la alta disponibilidad (HA)?

La alta disponibilidad (HA) es el diseño de una infraestructura para que siga funcionando aunque falle uno de sus componentes, eliminando los puntos únicos de fallo mediante redundancia y conmutación automática.

Equipo Cloud Privado Revisado el

Una infraestructura de alta disponibilidad no depende de ningún elemento individual. Si un servidor, un disco o un enlace de red falla, otro toma su lugar de forma automática y el servicio sigue operativo, idealmente sin que el usuario lo note.

En un cloud privado, la HA se consigue con clústeres de varios nodos: si un nodo cae, sus máquinas virtuales se reinician automáticamente en otro. Llevado al máximo, se replica entre dos datacenters con replicación síncrona para sobrevivir incluso a la pérdida de un emplazamiento completo.

La alta disponibilidad reduce el tiempo de caída pero no sustituye al backup ni al Disaster Recovery: protege frente a fallos de componentes, no frente a un borrado lógico, un ransomware o un error que se replica a los dos sitios.

Dos detalles deciden si un clúster de alta disponibilidad aguanta de verdad. El primero es el quórum: con dos nodos no hay mayoría posible, así que hace falta un tercero —o al menos un testigo— para que el clúster sepa quién sigue vivo cuando se corta la comunicación. El segundo es el fencing: apagar de forma fehaciente el nodo que se da por caído antes de arrancar sus máquinas en otro. Sin fencing, dos nodos pueden creerse los buenos a la vez y escribir sobre el mismo disco, que es el escenario del que rara vez se sale sin restaurar. Conviene además saber qué se está comprando: la HA reinicia la máquina en otro nodo, con lo que hay un corte de segundos o minutos; que siga ejecutándose sin interrupción es tolerancia a fallos, una función distinta y bastante más cara.

Preguntas frecuentes

¿Alta disponibilidad y Disaster Recovery son lo mismo?

No. La alta disponibilidad mantiene el servicio operativo ante fallos de hardware, normalmente de forma automática e instantánea. El Disaster Recovery es la recuperación tras un desastre mayor (incendio, ransomware) y suele implicar levantar en otro sitio. Se complementan.

Asesoría independiente · un solo interlocutor

¿Lo aplicamos a tu caso?

Cuéntanos tu proyecto y un especialista te propone la arquitectura, los plazos y el presupuesto. Sin coste y sin compromiso.

Respuesta en 24-48h Sin compromiso

Respuesta en 24–48 h laborables · Sin compromiso