Mise à l’échelle
Définissez les répliques, activez l’autoscaling et laissez les services inactifs se mettre en veille.
Mettez à l’échelle un service à la main avec des répliques, automatiquement avec l’autoscaling, ou jusqu’à zéro quand il est inactif.
Répliques et ressources#
Dans les Settings du service, la carte Resources fixe ce que reçoit chaque service. Les changements s’appliquent au prochain déploiement.
- Répliques
- Combien de copies tournent, de 1 à 10 (votre plan plafonne le maximum).
- Mémoire (Mo)
- Mémoire par réplique, par pas de 128 Mo.
- CPU (vCPU)
- CPU par réplique, par pas de 0,1 vCPU.
Autoscaling#
À partir de Pro, activez l’autoscaling pour ajouter et retirer des répliques selon la charge CPU. Définissez le minimum et le maximum de répliques et un pourcentage cible de CPU (10–95 %), et Gheima maintient la cible entre ces bornes.
Mise en veille à zéro (sleep)#
Définissez « Sleep after (minutes idle) » pour mettre un service à zéro quand il ne reçoit aucun trafic ; il se réveille automatiquement à la requête suivante. Mettez 0 pour désactiver.
La mise en veille est idéale pour la préproduction ou les services à faible trafic — vous ne payez pas les répliques endormies.
Pause et reprise#
Pour arrêter complètement un service, utilisez « Pause » dans la Danger zone — cela arrête toutes les répliques. Reprenez-le pour le relancer avec son nombre de répliques précédent.
Limites en un coup d’œil#
- Mémoire
- 128–8192 Mo par réplique.
- CPU
- 0,1–8 vCPU par réplique.
- Répliques
- 1–10, plafonné par votre plan.
- Cible CPU
- 10–95 % pour l’autoscaling.
- Mise en veille
- 0–1440 minutes (0 désactive).
L’autoscaling réagit uniquement à la charge CPU. La mémoire et le CPU par réplique restent fixés aux valeurs que vous définissez.
✦ Votre service utilise exactement la capacité nécessaire : répliques fixes, autoscaling piloté par le CPU, ou zéro pendant l’inactivité.