Pregunta de entrevista para Ingeniero DevOps

¿Qué pinta tiene una buena observabilidad para un servicio del que eres responsable?

Qué evalúa el entrevistador, cómo estructurar tu respuesta y un ejemplo hablado que puedes adaptar.

Respuesta rápida

Deberías poder responder preguntas que no anticipaste. Eso significa logs estructurados con un id de traza en cada línea, métricas que cubran tasa, errores y duración más la saturación de tus recursos clave, y trazas distribuidas que sigan una petición entre servicios. Las alertas saltan por síntomas visibles para el usuario y atados a tus objetivos de nivel de servicio, los paneles parten de la experiencia del cliente, y todas las señales comparten etiquetas coherentes para poder pivotar entre ellas.

Por qué lo preguntan los entrevistadores

El entrevistador quiere saber si instrumentas para depurar o solo recoges datos. Escucha la diferencia entre monitorizar modos de fallo conocidos y poder explorar los nuevos, la alerta basada en síntomas en vez de una alerta por componente, y la conciencia del coste, ya que las métricas de alta cardinalidad y las trazas sin muestreo pueden acabar costando más que el servicio que observan.

Cómo estructurar tu respuesta

  • Enmárcalo como responder preguntas no anticipadas, no como recoger datos.
  • Cubre las tres señales y para qué sirve realmente cada una.
  • Explica la correlación: ids de traza y etiquetas coherentes entre señales.
  • Trata la alerta por síntomas y el coste de la cardinalidad.

Ejemplo de respuesta

Ejemplo hablado, en primera persona

La prueba que uso es si puedo responder una pregunta en la que nadie pensó cuando se construyó el servicio, por ejemplo por qué las peticiones van lentas solo para un cliente en un endpoint. Para llegar ahí las tres señales tienen que estar conectadas. Cada línea de log es estructurada y lleva el id de traza, así que desde una traza lenta puedo saltar directo a los logs de esa petición en vez de buscar por marca de tiempo. Las métricas cubren tasa, errores y duración de cada endpoint como percentiles y no como medias, más la saturación de las cosas que de verdad se agotan: pools de conexiones, profundidad de cola, disco. Las trazas van muestreadas, pero siempre me quedo con los errores y con la cola lenta, porque la petición media no me enseña nada. Las alertas son la parte que la gente hace mal: alerto sobre síntomas que los clientes notan, atados al objetivo, no sobre que la CPU esté al ochenta por ciento. Y vigilo el coste, porque meter un id de usuario en una etiqueta de métrica es como conviertes una factura de doscientos en una de seis mil de la noche a la mañana; el detalle por usuario pertenece a las trazas y a los logs.

¿Tienes esta entrevista a la vuelta de la esquina? GhostPilot escucha tu llamada en vivo, detecta la pregunta en cuanto la hacen y pone una respuesta estructurada en tu pantalla en tiempo real. Pruébalo en tu próxima entrevista de práctica, o coge un Session Pass de $29, sin suscripción, para la de verdad.

Mira cómo funciona

Preguntas de seguimiento que puedes esperar

  • ¿Cómo decides una estrategia de muestreo de trazas?
  • ¿Qué harías con una alerta que salta cada semana y siempre se ignora?
  • ¿Cómo controlas el coste de las métricas de alta cardinalidad?

Más preguntas para Ingeniero DevOps

Tu entrevistador hará su propia versión de esta. Pega la descripción real del puesto en el Question Predictor gratuito y obtén las 20 preguntas que ese puesto tiene más probabilidades de hacerte, con lo que cada una busca en realidad.

Predecir mis preguntas

Ensaya las preguntas difíciles antes de que te las hagan

Practica con un copiloto en vivo y entra preparado. Un Session Pass de $29 te lleva a través de la entrevista sin suscripción y sin ataduras.

Consigue GhostPilot