¡Bienvenido!

Al registrarte con nosotros, podrás conversar, compartir y enviar mensajes privados con otros miembros de nuestra comunidad.

¡Regístrate ahora!

Perdimos 7 días de datos (sí, la cagamos)

  • Iniciador del tema Iniciador del tema Lucien
  • Fecha de inicio Fecha de inicio
  • Etiquetas Etiquetas
    datos
Lucien
Lucien

Lucien

{life++}
Moderador
Nivel 6
Veterano de la Comunidad Contribuyente Destacado Miembro Comprometido Conversador Frecuente
Mensajes
1,903
Hola comunidad,

No voy a dar rodeos porque estas cosas no tienen un lado bueno: hemos perdido aproximadamente 7 días de datos del foro.

Todo lo que se publicó, los mensajes privados, reacciones, registros de usuarios y cambios de perfil de esta última semana han desaparecido. Se han ido al limbo digital y no hay forma de recuperarlos.

La explicación corta es que el servidor sufrió un apagón repentino y la base de datos se corrompió de forma estrepitosa. Al no tener un backup lo suficientemente reciente, lo que se perdió entre el último respaldo y el apagón es irrecuperable.

La versión con nombres y apellidos: Como saben (algunos), el foro corre en un homelab que comparto con mi amigo ElKiro1311 Hubo un accidente doméstico, se desconectó la corriente y el servidor se apagó a lo bruto. ¿Fue culpa del Kiro? En parte sí, por el tirón del cable. ¿Pero fue mi culpa por no tener los backups automatizados? Absolutamente. Error de novato total que, después de tantos años en esto, no tiene justificación. Me confié y nos pasó factura.

Para los que quieren los detalles técnicos: El foro corre sobre un stack de Docker con XenForo:
  1. PHP 8.4 con FPM + NGINX
  2. MariaDB 11.8 (aquí fue donde murió todo)
  3. Redis para caché y sesiones
  4. Elasticsearch para las búsquedas
Hardware tenemos de sobra: un Unraid con dual Intel Xeon E5-2695 v4 (72 threads), 251GB de RAM y un array de 44TB con doble paridad. El hierro no es el problema, el problema es que MariaDB 11.8 es extremadamente sensible a los cortes de luz y las tablas InnoDB quedaron consistentes solo hasta hace una semana. La corrupción fue tan profunda que el motor simplemente no pudo reparar lo más reciente.

¿Qué hemos hecho para que no vuelva a pasar?

Para intentar redimirme, ya he implementado tres capas de seguridad que debieron estar ahí desde el día 1:
  1. Backups cada 12 horas: He configurado un cronjob que hace un dump completo y lo valida dos veces al día.
  2. Sincronización con Google Drive: He creado un script que sube esos backups automáticamente a una cuenta externa. Si el servidor explota, se inunda o el Kiro vuelve a tropezar con un cable, los datos están a salvo fuera de la casa.
Si publicaste algo importante o un hilo que te llevó tiempo y lo tienes guardado por ahí, te agradecería infinitamente si lo vuelves a subir. Si no tienes ganas de hacerlo, lo entiendo perfectamente, la culpa ha sido nuestra. Llevo años gestionando servidores y cometí el error más básico del manual: "ya configuraré el backup mañana". Ese "mañana" se convirtió en un "lo perdí todo". He aprendido la lección de la peor manera posible, pero les prometo que ahora el foro está más sólido que nunca.

Un saludo,

Lucien


Cómo bono, aquí tienen una foto del servidor:


Debes registrarte o iniciar sesión para ver este contenido.
 
Eso fue culpa de kenita que le dije que no subiera foto de ella jjj
Tremendo Server mira cuantos GB TIENE Y RAM pa la pin.
 
No digas eso mi amorcito, no fue tu culpa. Ven, te apapacho.



Tú sabes todos los mensajes de Freud que se eliminaron? Ese es el lado bueno.

Yo culpo a kenita , seguro tuvo algo que ver.
Todo lo que sea de dar dedo ahí estoy yo 😁😁😁😁😘

Eso fue culpa de kenita que le dije que no subiera foto de ella jjj
Tremendo Server mira cuantos GB TIENE Y RAM pa la pin.
Con esa cara de plasta de vaca 🐮,has acabado con todo . 🤣🤣
 
Atrás
Arriba