Choisir, acheter et faire vivre ses instances EC2 : types, modèles d'achat, états, Auto Scaling et load balancers !
AWS
Publié le
Karl Certa Admin systèmes & réseaux5 ans dans l'IT, passé par le support puis l'admin sys, aujourd'hui Ops. J'apprends le cloud et je pose tout au propre ici. Focus sur l'IaC & le cloud AWS SAA, prochaine étape Kubernetes LinkedIn karlcerta.fr GitHub Karl Certa
Amazon EC2 (Elastic Compute Cloud) est le service de machines virtuelles d’AWS : on choisit un type d’instance, une image, un modèle d’achat, et AWS fournit la capacité dans la zone de disponibilité (AZ, Availability Zone) demandée.
🏷️ Lire un nom de type d’instance
Un nom de type se lit en quatre parties : série, génération, options, puis taille après le point.
📌 Partie
📊 Exemple m7g.large
💡 Signification
🔤 Série
m
Famille d’usage (ici usage général)
🔢 Génération
7
Plus le chiffre est élevé, plus le matériel est récent
⚙️ Options
g
Processeur AWS Graviton (Arm)
📏 Taille
large
Nombre de processeurs virtuels (vCPU) et mémoire (metal pour du bare metal)
Séries principales
📌 Série
🎯 Orientation
💼 Cas d’usage typiques
T
Burstable : performance CPU de base, avec pics possibles
Petits serveurs web, dev/test, charges peu sollicitées
M
Usage général équilibré
Serveurs d’applications, backends
C
Compute optimized
Calcul intensif, batch, encodage
R / X
Memory optimized / memory intensive
Bases en mémoire, caches, analytique
I / D
Storage optimized / dense storage
Bases NoSQL, gros I/O sur disque local
P / G
Accéléré GPU
Entraînement machine learning, rendu graphique
Options courantes dans le nom
📌 Lettre
💡 Signification
a
Processeur AMD
g
Processeur AWS Graviton (Arm) : attention, il faut une AMI arm64
i
Processeur Intel
d
Volumes Instance Store (disques locaux) inclus
💰 Modèles d’achat
Les réductions sont exprimées « jusqu’à » par rapport au tarif On-Demand ; le taux réel dépend du type, de la région, de la durée et du paiement.
📌 Modèle d’achat
🔒 Engagement
💰 Réduction max
🎯 Cas d’usage
On-Demand
Aucun, facturation à la seconde (60 s minimum)
Aucune
Charge imprévisible, tests, besoins courts
Savings Plans
1 ou 3 ans, montant en $/heure
Jusqu’à 72 %
Charge de fond stable, recommandé par AWS avant les RI
Reserved Instances (RI)
1 ou 3 ans, attributs d’instance figés
Jusqu’à 72 %
Charge stable 24/7 sur un type connu
Spot
Aucun, instance reprise par AWS avec 2 min de préavis
Jusqu’à 90 %
Batch, intégration continue, rendu, tout job qui supporte l’interruption
Dedicated Instance
Aucun
Selon le modèle choisi
Matériel physique réservé à un seul compte
Dedicated Host
À l’heure ou réservation 1 / 3 ans
Réservation jusqu’à 70 %
Licences BYOL (Bring Your Own License) par socket ou cœur
Capacity Reservation
Aucun pour un usage immédiat
Aucune
Garantir de la capacité dans une AZ (événement, plan de reprise d’activité)
Savings Plans : lequel prendre
📌 Type
🌍 Portée
💰 Réduction max
Compute Savings Plans
EC2 toutes familles et régions, Fargate, Lambda
Jusqu’à 66 %
EC2 Instance Savings Plans
Une famille d’instances dans une région
Jusqu’à 72 %
Reserved Instances : les variantes
📌 Critère
📊 Options
💡 Conséquence
🔒 Classe
Standard / Convertible
Standard : meilleure réduction, seulement modifiable. Convertible : échangeable contre d’autres attributs, réduction moindre
💳 Paiement
All / Partial / No Upfront
Plus on paie d’avance, plus la réduction est forte
📍 Portée
Régionale / Zonale
Seule la RI zonale réserve de la capacité dans une AZ
⏳ Terme
Non annulable, pas de renouvellement automatique
Due jusqu’au bout même si l’instance est résiliée ; ensuite, tarif On-Demand
Spot, Dedicated et Capacity Reservation : les règles à retenir
📌 Élément
📊 Règle
💡 Pourquoi c’est important
⚡ Interruption Spot
Surtout quand EC2 récupère la capacité, ou si le prix Spot dépasse le prix max fixé
Fixer un prix max augmente la fréquence des interruptions
⏱️ Préavis Spot
2 minutes avant arrêt ou résiliation (via EventBridge et métadonnées)
Pas de préavis de 2 min si le comportement choisi est l’hibernation
🖥️ Dedicated Host
Facturé par hôte, visibilité sockets / cœurs, affinité d’hôte
Indispensable pour les licences liées au matériel physique
📦 Capacity Reservation
Facturée au tarif On-Demand, instance lancée dedans ou non
Aucune remise propre : la combiner avec Savings Plans ou RI régionales
HPC (High Performance Computing), faible latence entre nœuds
Spread
Plusieurs AZ, chaque instance sur un rack distinct
7 instances en cours d’exécution par AZ
Quelques instances critiques à isoler
Partition
Plusieurs AZ, chaque partition sur ses propres racks
7 partitions par AZ
HDFS, HBase, Cassandra
Spread isole chaque instance, d’où la limite basse. Partition isole des groupes : deux instances d’une même partition peuvent tomber ensemble, mais une panne de rack ne touche qu’une partition. Une panne de l’AZ fait tomber tout un placement group Cluster.
🌐 Elastic IP
📌 Élément
📊 Valeur
💡 Conséquence
📍 Portée
Une région, non déplaçable
Une Elastic IP (EIP) de eu-west-3 ne sert pas dans eu-central-1
🔢 Quota par défaut
5 Elastic IP par région
AWS conseille de les garder pour le basculement après panne, DNS pour le reste
📈 Auto Scaling Group (ASG)
📌 Élément
📊 Rôle
📄 Launch Template
Modèle d’instance : AMI, type, Security Groups, User Data, rôle
🔢 Min / Desired / Max
Le groupe ne descend jamais sous le min, ne dépasse jamais le max, vise le desired
🗺️ Multi-AZ
Instances réparties équitablement entre les AZ choisies
❤️ Health checks
Status checks EC2 par défaut, health checks ELB (Elastic Load Balancing) en option ; instance malade remplacée
🔗 Load balancer
Enregistrement et désenregistrement automatiques des instances
🪝 Lifecycle hooks
Pause au lancement ou à la résiliation (1 h par défaut) pour installer ou récupérer des logs
Politiques de scaling
📌 Politique
⚙️ Principe
🎯 Quand l’utiliser
Target tracking
Maintient une métrique à une cible (CPU moyen à 50 %)
Choix recommandé par AWS dans la plupart des cas
Step scaling
Ajustements par paliers selon l’ampleur du dépassement d’alarme
Réaction graduée à des seuils CloudWatch
Simple scaling
Un ajustement par alarme, puis cooldown (300 s par défaut)
Déconseillé par AWS, préférer target tracking ou step
Scheduled
Modifie min / desired / max à heure fixe (expression cron, fuseau horaire)
Charge prévisible : ouverture des bureaux, fin de semaine
Predictive
Prévoit la charge à partir de l’historique et lance la capacité en avance
Trafic cyclique, applications longues à démarrer
⚖️ Choisir un load balancer
📌 Load balancer
🧱 Couche
📊 Protocoles
🔀 Cross-zone par défaut
🎯 Cas d’usage
ALB (Application Load Balancer)
7
HTTP, HTTPS, gRPC
Toujours actif
Applications web, routage par chemin, hôte ou en-tête
NLB (Network Load Balancer)
4
TCP, UDP, TLS
Désactivé
Performances extrêmes, IP statique ou Elastic IP par AZ
GWLB (Gateway Load Balancer)
3 et 4
IP (GENEVE, port 6081)
Désactivé
Insérer des appliances tierces : pare-feu, détection et prévention d’intrusion
Les Security Groups (pare-feu stateful au niveau de l’instance) sont détaillés dans la fiche VPC.