Question d'entretien pour Ingénieur cloud

Comment fonctionne réellement l'autoscaling, et comment le réglez-vous ?

Ce que le recruteur cherche à évaluer, comment structurer votre réponse et un exemple parlé à adapter.

Réponse rapide

Une politique de scaling surveille une métrique et ajuste la capacité vers une cible, donc le suivi de cible maintient le CPU moyen ou le nombre de requêtes par instance près d'un point de consigne. Le réglage consiste à choisir une métrique qui reflète vraiment la charge, à tenir compte du temps de démarrage avant de compter la nouvelle capacité, à monter vite et redescendre lentement, et à fixer un minimum qui couvre chaque zone de disponibilité. Ajoutez de la capacité planifiée pour les pics prévisibles, puisque le scaling réactif est toujours en retard.

Pourquoi les recruteurs posent cette question

Le recruteur veut savoir si vous avez exploité de l'autoscaling ou si vous l'avez seulement activé. Il écoute le problème de latence de réaction, puisqu'un groupe qui met quatre minutes à démarrer ne peut pas répondre à un pic de soixante secondes, et le choix de la métrique, parce que le CPU est un mauvais indicateur de charge pour les services limités par les entrées-sorties. Savoir que le scale in provoque des connexions coupées trahit de vraies cicatrices opérationnelles.

Comment structurer votre réponse

  • Expliquez la boucle de contrôle : métrique, cible, ajustement de capacité.
  • Couvrez le choix de la métrique et pourquoi le CPU est souvent faux.
  • Traitez la latence : période de chauffe, temps de démarrage et scaling planifié.
  • Mentionnez l'asymétrie entre montée et descente, plus le drainage des connexions.

Exemple de réponse

Exemple parlé, à la première personne

C'est une boucle de rétroaction. Vous lui donnez une métrique et une cible, elle compare et ajoute ou retire de la capacité pour combler l'écart. La première décision, c'est la métrique, et le CPU est le choix par défaut souvent faux, parce qu'un service limité par les entrées-sorties peut être à trente pour cent de CPU pendant que son pool de connexions est épuisé. Le nombre de requêtes par instance ou la profondeur de file est en général un signal de charge plus vrai. La deuxième chose, c'est le retard, et c'est là que les gens se font mal. Si une instance met trois minutes à démarrer et à passer les health checks, alors un pic qui arrive en soixante secondes est terminé avant que les renforts n'arrivent, donc je fixe une période de chauffe pour que les nouvelles instances ne soient pas comptées avant d'être prêtes, et je pré-scale sur planning pour les motifs prévisibles comme la ruée de connexions de neuf heures du matin. Je rends la montée agressive et la descente douce, parce qu'être brièvement surprovisionné coûte beaucoup moins cher qu'une panne, et l'oscillation est pire que les deux. Et la descente a besoin de drainage des connexions, sinon vous coupez une instance en pleine requête et les utilisateurs voient des erreurs qui ressemblent à un bug.

Vous passez cet entretien bientôt ? GhostPilot écoute votre appel en direct, repère la question dès qu'elle est posée et affiche une réponse structurée à l'écran en temps réel. Essayez-le lors de votre prochain entretien blanc, ou prenez un Session Pass à $29, sans abonnement, pour le jour J.

Voir comment ça marche

Questions de relance à prévoir

  • Sur quelle métrique scaleriez-vous un worker de file d'attente ?
  • Comment empêchez-vous la descente de terminer une instance occupée ?
  • Que faites-vous quand le goulot d'étranglement est la base de données et non le niveau applicatif ?

Autres questions pour Ingénieur cloud

Votre recruteur posera sa propre version de celle-ci. Collez votre véritable fiche de poste dans le Question Predictor gratuit et obtenez les 20 questions que ce poste a le plus de chances de poser, avec ce que chacune cherche vraiment à sonder.

Prédire mes questions

Répétez les questions difficiles avant qu'on vous les pose

Entraînez-vous avec un copilote en direct, puis présentez-vous prêt. Un Session Pass à $29 vous accompagne pendant l'entretien, sans abonnement et sans engagement.

Obtenir GhostPilot