Mise à l’échelle

Définissez les répliques, activez l’autoscaling et laissez les services inactifs se mettre en veille.

Mettez à l’échelle un service à la main avec des répliques, automatiquement avec l’autoscaling, ou jusqu’à zéro quand il est inactif.

Répliques et ressources#

Dans les Settings du service, la carte Resources fixe ce que reçoit chaque service. Les changements s’appliquent au prochain déploiement.

Répliques
Combien de copies tournent, de 1 à 10 (votre plan plafonne le maximum).
Mémoire (Mo)
Mémoire par réplique, par pas de 128 Mo.
CPU (vCPU)
CPU par réplique, par pas de 0,1 vCPU.

Autoscaling#

À partir de Pro, activez l’autoscaling pour ajouter et retirer des répliques selon la charge CPU. Définissez le minimum et le maximum de répliques et un pourcentage cible de CPU (10–95 %), et Gheima maintient la cible entre ces bornes.

Mise en veille à zéro (sleep)#

Définissez « Sleep after (minutes idle) » pour mettre un service à zéro quand il ne reçoit aucun trafic ; il se réveille automatiquement à la requête suivante. Mettez 0 pour désactiver.

La mise en veille est idéale pour la préproduction ou les services à faible trafic — vous ne payez pas les répliques endormies.

Pause et reprise#

Pour arrêter complètement un service, utilisez « Pause » dans la Danger zone — cela arrête toutes les répliques. Reprenez-le pour le relancer avec son nombre de répliques précédent.

Limites en un coup d’œil#

Mémoire
128–8192 Mo par réplique.
CPU
0,1–8 vCPU par réplique.
Répliques
1–10, plafonné par votre plan.
Cible CPU
10–95 % pour l’autoscaling.
Mise en veille
0–1440 minutes (0 désactive).

L’autoscaling réagit uniquement à la charge CPU. La mémoire et le CPU par réplique restent fixés aux valeurs que vous définissez.

Votre service utilise exactement la capacité nécessaire : répliques fixes, autoscaling piloté par le CPU, ou zéro pendant l’inactivité.