Récupération de données
Récupération de données à Redon (35600)
À Redon, ne relancez ni réparation vSAN ni évacuation. Figez l’inventaire des hôtes, cache devices, capacity devices, objets, composants et witness. Le laboratoire image les supports séparément, reconstruit la carte UUID sur des copies et vérifie les namespaces prioritaires.
Diagnostic et devis
Lire la topologie vSAN avant les données
Le diagnostic commence par la chronologie du cluster: panne d’hôte, changement de contrôleur, remplacement de périphérique, resync ou modification de politique.
Les identifiants CMMDS sont recoupés avec les traces DOM, LSOM et CLOM.
La stabilité électrique et physique de chaque membre est vérifiée avant lecture intensive; les supports faibles sont priorisés pour l’imagerie.
La conclusion propose une carte d’objets candidate, la liste des VM prioritaires et les composants manquants.
- Cache devices SSD ou NVMe portant les journaux d’un disk group
- Capacity devices HDD ou flash avec les composants de données et témoins
- Disques de démarrage ESXi avec configuration et journaux vmkernel
- Contrôleurs HBA, câblages et backplanes documentant l’ordre physique des baies
- Exports CMMDS, RVC, Skyline Health ou esxcli collectés avant l’arrêt
- Descripteurs VM, namespaces, VMDK, snapshots et fichiers de configuration
- Sauvegardes et réplications externes à conserver hors du cluster
- Images bit à bit de chaque membre stable, sans réintégration dans vSAN
Attention
Éviter qu'une réparation vSAN remplace la dernière carte utile
- Ne cliquez pas sur Repair Objects Immediately
- N’évacuez pas les données d’un hôte dégradé
- Ne recréez aucun disk group avec les mêmes périphériques
- Ne reformatez pas un disque déclaré absent
- Ne modifiez pas la Storage Policy pour forcer la conformité
- Ne remettez pas tous les hôtes sous tension sans ordre
- Conservez les journaux ESXi et vCenter
- Isolez les sauvegardes externes
Une resynchronisation peut écrire de nouveaux composants et faire expirer des états comparables; tant que les disk groups ne sont pas imagés, les réparations restent suspendues.
Comment ça marche
Des UUID distribués aux VM vérifiées
- Bloquez les resynchronisations, les réparations d’objets, les évacuations, les reformatages et les remplacements tant que la topologie n’est pas capturée.
- Photographiez les baies et associez chaque numéro de série à son hôte, contrôleur, slot et rôle.
- Exportez les états déjà lisibles: membership, disk group UUID, object UUID, component state, policy et witness.
- Le laboratoire diagnostique chaque HDD ou SSD hors du cluster, puis copie les supports stables.
- Une carte de travail rapproche les UUID CMMDS, composants DOM et emplacements LSOM.
- Les chaînes candidates sont testées sur un environnement isolé pour retrouver namespaces et descripteurs.
- Les VM prioritaires sont validées par fichiers et périodes; l’état absent, stale ou incomplet reste consigné.
Nos expertises
Supports et métadonnées d'un cluster vSAN dégradé
Préparer le devis
Figer la carte du cluster avant l'envoi
Les positions physiques et les UUID logiques doivent rester associés pendant la prise en charge.
- Suspendre les resynchronisations et réparations
- Noter la chronologie des pannes et remplacements
- Photographier chaque baie avant extraction
- Associer numéros de série, hôtes et slots
- Exporter les états CMMDS accessibles
- Conserver les journaux ESXi et vCenter
- Lister les VM et périodes prioritaires
- Isoler les sauvegardes externes
- Arrêter les membres instables
- Préserver les accès légitimes
Notre expertise
Une analyse vSAN guidée par les identifiants
VSAN distribue un objet selon une politique; composants de données, témoins, votes et métadonnées ne se trouvent pas forcément sur le même hôte.
CMMDS donne le vocabulaire de la reconstruction; les UUID d’objets, de composants et de disk groups relient une pièce physique à son rôle logique, même quand vCenter ne présente plus de vue cohérente.
Le cache tier et le capacity tier n’ont pas la même fonction; un SSD cache défaillant ne doit pas conduire à agréger au hasard les capacity devices.
Le diagnostic matériel reste indépendant de la reconstruction vSAN; la salle blanche n’intervient que si un HDD mécanique doit être ouvert.
Une VM n’est déclarée exploitable qu’après contrôle de son namespace, de ses descripteurs, de la chaîne de snapshots et d’un échantillon de fichiers.
- CMMDS
- Figer les UUID
- Disk groups
- Conserver les rôles
- Objets
- Cartographier les composants
- VM
- Valider les namespaces
Prise en charge
Documenter un cluster envoyé depuis Redon
La prise en charge depuis Redon n’implique aucune implantation technique locale; les hôtes ou supports sont orientés vers le laboratoire adapté selon leur état.
Préparez les versions ESXi, vCenter et vSAN, le nombre d’hôtes et la politique des VM critiques.
Étiquetez les disques sans les sortir tous de leur slot; photos des baies, numéros de série et positions complètent les exports.
Un support bruyant, chaud ou intermittent reste arrêté; aucune reconstruction RAID générique ne remplace la lecture des objets vSAN.
Le devis distingue l’acquisition des membres, l’analyse de topologie, la reconstruction et la validation des VM.
UUID et composants à cartographier
Recomposer des objets vSAN sans resync destructif
Le dossier couvre les disk groups, cache devices, capacity devices, objets, witness, politiques et namespaces.
Une copie de travail peut réunir des éléments de plusieurs hôtes, mais chaque composant conserve son UUID, son état et son emplacement d’origine.
Les HDD, SSD, NVMe, contrôleurs et serveurs sont traités selon leur technologie; la salle blanche ne concerne qu’un HDD endommagé.
La restitution priorise les VM et périodes demandées; snapshots incomplets, descripteurs absents et composants non recoupés sont listés.
- Disk group Relier cache, capacité, hôte et génération.
- CMMDS Conserver les UUID et états distribués.
- Composants Distinguer données, witness et fragments stale.
- Namespace Retrouver les descripteurs de la machine virtuelle.
- Contrôle Vérifier les fichiers prioritaires hors production.
Carte
Orientation depuis Redon pour un incident vSAN
FAQ
Questions sur vSAN et la récupération à Redon
Pourquoi suspendre Repair Objects Immediately?
La réparation crée de nouveaux composants et modifie la carte avant acquisition des états précédents.
Un objet compliant garantit-il une VM lisible?
Non. Le namespace, les descripteurs, les snapshots et les fichiers prioritaires doivent encore être contrôlés.
Faut-il garder les cache devices?
Oui. Leur rôle, leurs métadonnées et leur appartenance au disk group peuvent être déterminants.
Peut-on recréer un disk group avec les anciens disques?
Pas avant acquisition; la recréation reformate des structures et détruit la génération précédente.
À quoi servent les UUID CMMDS?
Ils relient objets, composants, hôtes et disk groups quand l’interface de gestion ne fournit plus de vue complète.
La salle blanche concerne-t-elle les SSD vSAN?
Non. Elle est réservée à l’ouverture d’un HDD mécanique; les SSD et NVMe relèvent de procédures électroniques.
Les sauvegardes doivent-elles rester connectées?
Non pendant la qualification; leur isolement évite une rétention ou un écrasement automatique.
Comment choisir les VM prioritaires?
Précisez leur nom, leur fonction, la période recherchée et quelques fichiers témoins.
Peut-on redémarrer un seul hôte pour exporter des logs?
Seulement après décision technique; un redémarrage peut changer les états.
Diagnostic et devis
Faire qualifier les objets avant de reconstruire le cluster
Indiquez les hôtes, versions, changements récents, VM prioritaires et états observés; le laboratoire pourra chiffrer une acquisition et une reconstruction sans annoncer la récupération avant examen.