forgium-website/Idées/04_MONITORING_ET_BACKUPS/supervision_et_backups.md

990 B

04 - MONITORING ET STRATÉGIE DE SAUVEGARDES

Monitoring & Télémétrie

  • Uptime Kuma : Page de statut publique (ex: status.forgium.net) et alertes Discord/Telegram en cas de panne.
  • Node Exporter + Prometheus + Grafana :
    • Suivi en temps réel de l'utilisation CPU (Ryzen 3700X), RAM (20 Go), I/O disques SSD/HDD.
    • Surveillance spécifique de la latence du CPL.

Politique de Sauvegarde (3-2-1 Adaptée)

  • Règle absolue : Les données des utilisateurs doivent être restaurables en moins de 30 minutes en cas de crash d'un conteneur.
  • Dépôt 1 (Local chaud) : Snapshots quotidiens Proxmox sur SSD.
  • Dépôt 2 (Local froid) : Backups hebdomadaires / quotidiens consolidés sur le HDD externe 500 Go via Proxmox Backup Server (PBS) ou script vzdump.
  • Dépôt 3 (Distant / Offsite léger) : Dump des bases de données et configurations critiques synchronisés vers un stockage cloud gratuit (ex: Backblaze B2, Google Drive, ou VPS de secours).