Infraestructura

RAID y almacenamiento: qué protege y qué no

RAID distribuye o replica datos entre discos, pero no sustituye a una copia de seguridad independiente.

Ilustración técnica sobre raid y almacenamiento: qué protege y qué no

RAID combina varios discos para mejorar disponibilidad, capacidad o rendimiento según el nivel utilizado. No es una copia de seguridad y no protege por igual frente a borrados, corrupción lógica, ransomware o pérdida del servidor completo.

La elección debe partir del fallo que se quiere tolerar y del procedimiento de sustitución y restauración disponible.

Qué problema intenta resolver

Un espejo puede mantener una copia en otro disco; un nivel con paridad puede reconstruir datos después de la pérdida de una unidad; un esquema distribuido puede equilibrar capacidad y rendimiento. Cada opción consume parte del espacio útil y tiene un tiempo de reconstrucción.

Capacidad frente a tolerancia

RAID 1 sacrifica capacidad para duplicar datos. RAID 5 y RAID 6 usan paridad y toleran una o dos pérdidas según el nivel, pero las escrituras y la reconstrucción tienen coste. RAID 10 combina espejos y distribución y suele ser atractivo para cargas con muchas operaciones, aunque necesita más discos.

La capacidad anunciada no es la capacidad disponible para la aplicación. Reserva espacio y considera discos de repuesto.

La reconstrucción es una fase de riesgo

Cuando se sustituye un disco, el sistema lee el resto para reconstruir la información. Durante ese periodo puede bajar el rendimiento y una segunda avería puede superar la tolerancia del nivel. Monitoriza estado, temperatura, errores y progreso; no esperes a que falle otro disco para descubrir que una alerta estaba desactivada.

Lo que RAID no cubre

Un usuario puede borrar una carpeta que RAID replicará. Un proceso puede corromper datos que se escribirán en todos los miembros. Un atacante con acceso al servidor puede cifrar el volumen completo. Conserva copias separadas, prueba restauraciones y protege sus credenciales.

Elegir con la carga real

Una base de datos necesita considerar latencia y escrituras; un archivo grande puede priorizar transferencia secuencial. El controlador, la caché y el almacenamiento subyacente también influyen. No selecciones el nivel solo por la cantidad de discos.

Qué documentar

Registra nivel, discos, capacidad útil, procedimiento de sustitución, alertas y copias. Si el proyecto necesita recursos dedicados, revisa servidores dedicados, pero no confundas una plataforma física con una estrategia de recuperación completa.

RAID por hardware y por software

Un controlador dedicado puede presentar un volumen lógico, mientras que RAID por software lo gestiona el sistema operativo. Ambos tienen ventajas y responsabilidades: el controlador también puede fallar y el volumen por software necesita que el administrador conozca sus herramientas de recuperación.

Alertas y sustitución

Una unidad degradada debe generar una alerta clara. Comprueba que la sustitución sea compatible, que el disco de repuesto esté disponible y que la reconstrucción no sature una aplicación crítica. No retires discos para probar una hipótesis sin un procedimiento.

Copia independiente

Conserva una copia fuera del conjunto RAID, con credenciales separadas y restauraciones periódicas. El volumen puede seguir disponible mientras la información lógica está dañada, por lo que disponibilidad y recuperación deben medirse por separado.

Rendimiento durante la reconstrucción

La reconstrucción lee grandes cantidades de datos y compite con las operaciones normales. Programa sustituciones cuando la carga sea menor, controla la cola y verifica que existe una alerta si el proceso se detiene. Un volumen degradado no debe permanecer semanas sin una decisión.

Capacidad útil y crecimiento

Calcula espacio después de aplicar la redundancia y deja margen para snapshots, logs y crecimiento. Llenar el volumen puede degradar rendimiento y hacer imposible una reconstrucción temporal. El tamaño de los discos también condiciona cuánto durará la operación.

Recuperación más allá del disco

Prueba recuperar una base de datos, un archivo y la configuración de la aplicación desde una copia externa. Si el servidor completo se pierde, el conjunto RAID no viaja con él. La copia y el procedimiento deben poder utilizarse en otro entorno compatible.

El nivel debe responder a un riesgo concreto

Si el objetivo es seguir operativo ante una avería de disco, RAID puede ayudar. Si el objetivo es recuperar datos borrados o un servidor cifrado, necesitas copias y un procedimiento independiente. Expresar el riesgo en esos términos evita asignar al volumen una protección que no ofrece.

Revisa la decisión cuando cambien capacidad, carga o requisitos de recuperación.

Comprobar la copia de seguridad

Una copia debe poder restaurarse en un volumen o servidor compatible, con permisos y configuración suficientes para que la aplicación arranque. Comprueba archivos, base de datos y secretos por separado y registra el tiempo necesario.

Si una copia depende del mismo controlador, cuenta o red que el RAID, un incidente común puede afectar a ambos. La separación lógica y administrativa es parte de la recuperación.

La revisión debe incluir una prueba de restauración y una alerta de disco degradado. Si una de esas piezas falla, el volumen puede dar una falsa sensación de protección.

La tolerancia a una avería no evita el desgaste de las unidades restantes. Tras una sustitución, confirma el estado del conjunto y deja documentada la fecha de la reconstrucción.

La capacidad y el rendimiento deben revisarse cuando crece la aplicación.

El equipo debe saber qué alerta abre una sustitución y cómo se comprueba el volumen después. La disponibilidad del conjunto depende también de esa operación.

Haz esta comprobación después de cada cambio del conjunto.