Pregunta de entrevista para Site Reliability Engineer

Marketing te dice que una campaña traerá diez veces el tráfico normal el próximo martes. ¿Qué haces?

Qué evalúa el entrevistador, cómo estructurar tu respuesta y un ejemplo hablado que puedes adaptar.

Respuesta rápida

Haz pruebas de carga contra el cuello de botella real y no contra la capa web. Deriva la capacidad por componente a partir del tráfico actual y del margen, y luego examina lo que no escala horizontalmente: rendimiento de escritura de la base de datos, límites de conexiones, límites de tasa de terceros y cuotas de la nube. Preescala en lugar de confiar en que el autoescalado reaccione a tiempo, sube las cuotas por adelantado, prepara un plan de descarte y degradación, y asigna guardia para la ventana.

Por qué lo preguntan los entrevistadores

El trabajo de capacidad revela si piensas en sistemas o en servidores. Los entrevistadores quieren oír que encuentras el recurso limitado, que sabes que el autoescalado tiene un tiempo de reacción y un techo de cuota, y que planificas la degradación elegante. Mencionar que validarías el número y la forma que da marketing (un pico, no una meseta) es una señal fuerte.

Cómo estructurar tu respuesta

  • Aclara la forma del tráfico: tasa pico, duración y mezcla.
  • Modela el margen por componente a partir de la utilización actual.
  • Haz pruebas de carga para encontrar el cuello de botella real, normalmente con estado.
  • Preescala y sube cuotas y límites antes de la ventana.
  • Prepara el plan de degradación y asigna personal al evento.

Ejemplo de respuesta

Ejemplo hablado, en primera persona

Primero concretaría qué significa diez veces, porque diez veces a lo largo de un día es un problema distinto de diez veces en los primeros cuatro minutos de un envío de correo, y las campañas casi siempre son lo segundo. Después modelo cada capa a partir del uso actual: si hoy vamos al 30% de CPU en pico, la capa sin estado es fácil, pero las partes interesantes son las que no escalan añadiendo pods. Para nosotros eran el rendimiento de escritura de Postgres y un proveedor de pagos con un límite de tasa al que nunca nos habíamos acercado, y eso requería una llamada de teléfono y una semana de antelación. Haría una prueba de carga que golpee la ruta real y no un chequeo de salud sintético, y preescalaría en lugar de fiarme del autoescalador, porque un arranque en frío de noventa segundos es una eternidad en un pico. Por último, un plan de degradación escrito: qué apagamos primero, quién puede activarlo, y un canal compartido con marketing para poder pausar el envío.

¿Tienes esta entrevista a la vuelta de la esquina? GhostPilot escucha tu llamada en vivo, detecta la pregunta en cuanto la hacen y pone una respuesta estructurada en tu pantalla en tiempo real. Pruébalo en tu próxima entrevista de práctica, o coge un Session Pass de $29, sin suscripción, para la de verdad.

Mira cómo funciona

Preguntas de seguimiento que puedes esperar

  • ¿Qué apagarías primero si tuvieras que degradar durante el pico?
  • ¿Cómo harías pruebas de carga sin afectar a los usuarios de producción?
  • ¿Qué cuotas de nube revisarías antes de un evento así?

Más preguntas para Site Reliability Engineer

Tu entrevistador hará su propia versión de esta. Pega la descripción real del puesto en el Question Predictor gratuito y obtén las 20 preguntas que ese puesto tiene más probabilidades de hacerte, con lo que cada una busca en realidad.

Predecir mis preguntas

Ensaya las preguntas difíciles antes de que te las hagan

Practica con un copiloto en vivo y entra preparado. Un Session Pass de $29 te lleva a través de la entrevista sin suscripción y sin ataduras.

Consigue GhostPilot