Question d'entretien pour Ingénieur SRE

Comment choisissez-vous entre délester la charge et scaler horizontalement quand un service est surchargé ?

Ce que le recruteur cherche à évaluer, comment structurer votre réponse et un exemple parlé à adapter.

Réponse rapide

L'autoscaling prend des minutes, donc délestez d'abord et scalez ensuite. Délestez quand le goulot d'étranglement est quelque chose auquel vous ne pouvez pas ajouter de capacité rapidement, comme une base de données, une dépendance sous licence ou un service à démarrage à froid lent, ou quand les files grossissent plus vite que vous ne pourriez jamais les vider. Jetez d'abord le travail le moins cher et le moins important, renvoyez 429 avec Retry-After, et protégez les requêtes qui portent le chiffre d'affaires ou la sécurité.

Pourquoi les recruteurs posent cette question

Le recruteur teste votre compréhension des constantes de temps. Les candidats qui disent seulement scaler n'ont jamais ressenti l'écart entre le déclenchement de l'alerte et la nouvelle capacité qui sert le trafic. Les bonnes réponses couvrent la priorisation des classes de trafic, le danger de scaler un étage sans état vers un goulot avec état, et la dégradation progressive comme comportement conçu plutôt que comme accident.

Comment structurer votre réponse

  • Opposez le temps de délestage (immédiat) au temps de scaling (des minutes).
  • Identifiez d'abord le goulot, puisque scaler le mauvais étage aggrave les choses.
  • Définissez les classes de trafic et lesquelles sont jetées en premier.
  • Précisez le mécanisme : 429 avec Retry-After, limites de file, mode dégradé.

Exemple de réponse

Exemple parlé, à la première personne

Le délestage est immédiat et le scaling ne l'est pas, donc en surcharge réelle je déleste d'abord et je laisse la capacité rattraper. La plus grande question, c'est de savoir où est vraiment le goulot. Ajouter des pods sans état quand la contrainte est le nombre de connexions à la base est carrément nuisible, parce que chaque nouveau pod ouvre un pool et vous accélérez l'effondrement. On a eu exactement ça pendant une vente flash, jusqu'à ce qu'on mette un proxy de connexions devant et qu'on plafonne le total. Pour le délestage, j'aime les classes de trafic explicites. Les appels de paiement et de commande sont en classe un et ne sont jamais jetés, la navigation connectée est en classe deux, et le crawl anonyme plus les appels de recommandation non essentiels sont en classe trois et partent en premier. On l'appliquait en périphérie avec un limiteur de concurrence et on renvoyait 429 avec un en-tête Retry-After pour que les clients bien élevés lèvent le pied au lieu de cogner. Combinez ça avec un mode dégradé qui sert des listes en cache, et vous restez debout pour le trafic qui compte.

Vous passez cet entretien bientôt ? GhostPilot écoute votre appel en direct, repère la question dès qu'elle est posée et affiche une réponse structurée à l'écran en temps réel. Essayez-le lors de votre prochain entretien blanc, ou prenez un Session Pass à $29, sans abonnement, pour le jour J.

Voir comment ça marche

Questions de relance à prévoir

  • Comment implémenteriez-vous des limites de concurrence adaptatives en périphérie ?
  • Quel signal utiliseriez-vous pour décider du début du délestage ?
  • Comment empêchez-vous l'autoscaling d'aggraver un goulot de base de données ?

Autres questions pour Ingénieur SRE

Votre recruteur posera sa propre version de celle-ci. Collez votre véritable fiche de poste dans le Question Predictor gratuit et obtenez les 20 questions que ce poste a le plus de chances de poser, avec ce que chacune cherche vraiment à sonder.

Prédire mes questions

Répétez les questions difficiles avant qu'on vous les pose

Entraînez-vous avec un copilote en direct, puis présentez-vous prêt. Un Session Pass à $29 vous accompagne pendant l'entretien, sans abonnement et sans engagement.

Obtenir GhostPilot