1. Cadrage et dimensionnement
- Inventorier CPU, RAM, stockage, IOPS, interfaces, dépendances, fenêtres de sauvegarde et licences
- Mesurer les pointes, pas seulement les moyennes
- Définir RPO, RTO et ordre de redémarrage des services
- Réserver une capacité de panne : un cluster HA doit absorber la perte d’un nœud
- Vérifier la compatibilité matérielle et le support de chaque application
| Plan | Éléments à séparer |
|---|---|
| Gestion | Interfaces hyperviseurs, cluster, consoles |
| Machines virtuelles | VLAN serveurs par niveau de confiance |
| Stockage | iSCSI/NFS/Ceph/vSAN selon architecture |
| Migration | Trafic de migration à chaud |
| Sauvegarde | Dépôt et réseau non administrables par les mêmes comptes |
2. Déployer Proxmox VE
- Valider matériel, firmware, virtualisation CPU et contrôleurs de stockage.
- Installer sur des disques système dédiés et configurer un réseau de gestion non exposé à Internet.
- Appliquer la configuration de dépôts correspondant à l’abonnement.
- Créer stockage, ponts réseau et rôles avant les premières VM.
- Sauvegarder la configuration et tester une restauration de VM avant la production.
pveversion -v
pvesm status
pvecm status
qm list
pct listUn cluster Proxmox exige une latence stable et un quorum fiable. La documentation officielle recommande au moins trois nœuds pour un quorum HA robuste ; ne pas étirer un cluster sur un lien instable sans conception dédiée.
3. Déployer VMware vSphere
- Vérifier la matrice de compatibilité Broadcom pour serveurs, contrôleurs, pilotes et versions.
- Installer ESXi sur un réseau de gestion isolé et synchroniser le temps.
- Déployer vCenter selon le dimensionnement officiel.
- Créer datacenter, cluster, commutateurs, stockage et rôles nominatifs.
- Appliquer les licences et tester sauvegarde/restauration de configuration et de VM.
Les versions, éditions et droits commerciaux changent. La documentation d’exploitation doit enregistrer les clés, contrats, dates de fin de support et fonctions effectivement autorisées, sans supposer qu’une fonction d’une ancienne édition reste incluse.
4. Stockage, snapshots et sauvegardes
| Mécanisme | Utilité | Limite |
|---|---|---|
| Snapshot | Retour court avant changement | Ce n’est pas une sauvegarde ; durée et croissance à limiter |
| Réplication | Reprise sur autre nœud/site | Réplique aussi corruption ou suppression |
| Sauvegarde image | Restauration VM complète | Dépôt à isoler et restaurations à tester |
| Sauvegarde applicative | Cohérence AD, SQL, messagerie | Nécessite un traitement propre à l’application |
- Isoler les identités et le stockage de sauvegarde du plan d’administration des hyperviseurs
- Conserver au moins une copie immuable ou hors ligne
- Tester restauration complète et granulaire
- Mesurer la durée réelle de restauration pour valider le RTO
5. Sécurité d’exploitation
- MFA et comptes nominatifs pour les consoles quand la plateforme le permet
- Rôles minimaux et compte de secours sous contrôle
- Interfaces de gestion sur réseau dédié accessible depuis des postes d’administration
- Correctifs selon bulletins éditeur et fenêtre maîtrisée
- Journalisation centralisée et alertes sur connexions, changements de rôles et arrêts
- Aucun accès direct des utilisateurs aux hyperviseurs
La compromission d’un hyperviseur donne potentiellement accès à toutes les charges hébergées. Il doit être classé au même niveau critique que les contrôleurs de domaine et les systèmes de sauvegarde.
6. Migration entre plateformes
- Cartographier dépendances, IP, VLAN, disques, snapshots, agents et licences.
- Valider une méthode de conversion officiellement supportée.
- Tester une VM non critique et mesurer arrêt, conversion et contrôles.
- Effectuer une sauvegarde indépendante avant la bascule.
- Prévoir coexistence et retour arrière sans écriture concurrente.
- Après bascule, retirer les anciens outils invités et tester application, sauvegarde et supervision.
7. Diagnostic rapide
| Symptôme | Axes de contrôle |
|---|---|
| VM lente | CPU ready/steal, mémoire, swap/ballooning, latence stockage, saturation réseau |
| Migration impossible | Compatibilité CPU, réseau, stockage partagé, droits, certificats |
| Nœud hors cluster | Quorum, heure, DNS, MTU, pare-feu, versions |
| Sauvegarde échouée | Espace, verrou, snapshot, agent invité, débit, journal du dépôt |
Conserver les journaux et métriques avant de redémarrer. Un redémarrage peut masquer la cause et supprimer les indices nécessaires à l’analyse.
Sources officielles et documentation éditeur
Les commandes sont des modèles à adapter. Vérifiez la version installée, les prérequis, les sauvegardes et le plan de retour arrière avant toute modification en production.
- Proxmox — guide d’administration officiel ↗
- Proxmox — Cluster Manager et quorum ↗
- VMware by Broadcom — présentation officielle vSphere ↗
- ANSSI — sécurisation d’une infrastructure VMware ↗
Dossier technique produit par Donnella. Dernière revue documentaire : août 2026.