Deduplicación: más versiones sin repetir todos tus datos
Deduplicación: más versiones sin repetir todos tus datos
Entiende cómo un backup deduplicado aprovecha el almacenamiento, en qué se diferencia de comprimir archivos y cómo calcular la capacidad que necesitas.

Si una web ocupa 50 GB, ¿guardar veinte versiones obliga a contratar 1 TB? No necesariamente. La deduplicación en copias de seguridad evita almacenar de nuevo bloques de datos que el repositorio ya contiene. Cada versión puede ofrecer una vista recuperable del sitio sin repetir físicamente todo su contenido.
Es una de las capacidades del servicio Backup de ALMC. Lo importante no es el nombre de la tecnología, sino comprender qué ahorra, qué sigue ocupando espacio y cómo comparar una oferta de almacenamiento.
Qué hace un backup deduplicado
Piensa en varias versiones de una carpeta. Muchos archivos permanecen iguales y otros cambian parcialmente. Un sistema de deduplicación por bloques identifica contenido ya presente y lo reutiliza mediante referencias; almacena los bloques nuevos necesarios para representar los cambios.
Esto no equivale a conservar únicamente la última versión. El historial puede seguir permitiendo seleccionar puntos anteriores mientras se conserven sus datos y metadatos. El repositorio debe permanecer íntegro: las referencias no sustituyen los bloques de los que dependen.
Ejemplo de capacidad: versiones lógicas frente a espacio real
Supongamos un conjunto inicial de 50 GB y nueve copias posteriores que añaden, cada una, 2 GB de bloques nuevos únicos. Un cálculo simplificado sería 50 + (9 × 2) = 68 GB, frente a los 500 GB que resultarían de duplicar diez veces los 50 GB iniciales.
Es un ejemplo didáctico, no una previsión ni un ahorro garantizado. Ignora compresión, índices, metadatos y otros costes del repositorio. Además, esos 2 GB representan bloques nuevos únicos, no simplemente el tamaño de los archivos modificados que muestra el sistema operativo.
Una base de datos reordenada, un archivo comprimido regenerado o datos cifrados antes de copiarse pueden producir cambios muy distintos. Para dimensionar un servicio hay que observar copias reales durante un periodo representativo.
Deduplicación, compresión e incrementales no son lo mismo
La compresión intenta representar unos datos usando menos espacio. La deduplicación evita repetir contenido ya almacenado. Son técnicas distintas y pueden complementarse.
Una copia incremental recoge cambios respecto a un estado anterior. Puede trabajar por archivos o por bloques, y también puede utilizar deduplicación. Por tanto, no es correcto afirmar que cualquier copia incremental sea inferior: hay que comparar la implementación, el historial disponible, la recuperación y el coste operativo.
La ventaja práctica de un repositorio deduplicado es aprovechar contenido compartido para conservar versiones sin multiplicar el almacenamiento como si cada punto fuese otra copia completa independiente. Aun así, la recuperación depende de los datos compartidos conservados en el repositorio.
Qué consume la capacidad contratada en Backup
El almacenamiento utilizado no se obtiene sumando sin más el tamaño lógico de todas las versiones. Debe revisarse la ocupación del repositorio, los datos nuevos y la política de retención. El historial es útil precisamente porque conserva cambios: más actividad y más tiempo de conservación pueden requerir más capacidad.
La deduplicación actúa dentro del ámbito del repositorio configurado. No presupongas que dos repositorios independientes, o los datos de clientes distintos, compartirán almacenamiento. Tampoco confundas espacio liberado al retirar una versión con espacio recuperado inmediatamente: el mantenimiento del repositorio puede intervenir en ese proceso.
Por qué los ZIP y SQL olvidados merecen una revisión
Un plugin puede guardar un ZIP completo cada noche dentro de la web. Aunque contenga información similar, cada archivo regenerado puede reducir la reutilización de bloques. Los volcados SQL también pueden crecer o variar considerablemente.
Antes de excluirlos, identifica su finalidad y quién los necesita. Excluir todo lo que termina en ZIP o SQL sería una política demasiado amplia. La guía de errores habituales en backups de empresa explica por qué conviene combinar inventario, alertas y una política explícita.
Cómo elegir un plan de backup sin quedarse corto
- Mide el volumen inicial realmente protegido, incluidas las bases de datos.
- Observa cuánto contenido nuevo añade un ciclo normal de trabajo.
- Define cuántas versiones y cuánto tiempo necesitas conservar.
- Deja margen para crecimiento, tareas de mantenimiento y cambios excepcionales.
- Revisa la ocupación y ajusta antes de acercarte al límite.
En una agencia, una nueva web con muchas imágenes puede cambiar el consumo más que decenas de sitios pequeños. La capacidad adecuada se calcula con el conjunto de datos y su actividad, no solo con el número de dominios.
Más historial útil, con condiciones claras
Consulta los planes y precios orientativos de Backup y solicita una estimación basada en tu volumen. Si trabajas con alojamiento web, revisa además la integración con Plesk. El objetivo es conservar puntos de recuperación útiles con un uso eficiente del espacio, sin prometer capacidad ilimitada ni porcentajes universales de ahorro.
