Acusa recibo del aviso, confirma el impacto en usuarios y declara un incidente con un responsable claro y un canal de comunicación. Luego corta la hemorragia antes de diagnosticar: mira qué cambió hace poco y revierte o desactiva al sospechoso si la cronología encaja. Mantén una línea de tiempo de acciones en el canal, comunica a las partes interesadas con una cadencia fija y empieza el análisis de causa raíz solo cuando el impacto esté contenido.
Por qué lo preguntan los entrevistadores
Esto va de temperamento y proceso tanto como de habilidad técnica. El entrevistador quiere ver que separas la mitigación del diagnóstico, que estableces roles en vez de que todo el mundo depure en paralelo, y que comunicas. Quien se lanza directo al análisis de logs sin confirmar el impacto ni revisar los despliegues recientes tiende a alargar las caídas, y esta pregunta saca ese instinto a la luz rápido.
Cómo estructurar tu respuesta
- Acusa recibo, confirma el impacto real en usuarios y declara con un responsable.
- Prioriza la mitigación sobre el diagnóstico y di por qué.
- Revisa primero los cambios recientes como la hipótesis de mayor rendimiento.
- Cubre la cadencia de comunicación y el mantenimiento de una línea de tiempo.
Ejemplo de respuesta
Primero acuso recibo del aviso para que nadie más duplique el trabajo, luego compruebo si los usuarios están afectados de verdad, porque que salte una alerta y que los clientes sufran no siempre son lo mismo. Si es real, declaro un incidente, asumo el mando o se lo paso a otra persona de forma explícita, y abro un canal para que haya un único sitio con la línea de tiempo. Después, mitigar antes que diagnosticar. La pregunta de mayor rendimiento es qué cambió, así que miro los despliegues recientes, los feature flags y los cambios de infraestructura de las últimas horas, y si algo encaja con el inicio del impacto, lo revierto o apago el flag. No necesito entender el bug para dejar de hacer daño a la gente. Mientras eso pasa publico una actualización con una cadencia fija, más o menos cada quince o veinte minutos, incluso cuando la actualización es que seguimos investigando, porque el silencio hace que la gente venga a preguntar individualmente. Y voy anotando acciones con marcas de tiempo sobre la marcha, en parte para el postmortem y en parte para que quien se incorpore pueda ponerse al día sin interrumpir.
¿Tienes esta entrevista a la vuelta de la esquina? GhostPilot escucha tu llamada en vivo, detecta la pregunta en cuanto la hacen y pone una respuesta estructurada en tu pantalla en tiempo real. Pruébalo en tu próxima entrevista de práctica, o coge un Session Pass de $29, sin suscripción, para la de verdad.
Mira cómo funcionaPreguntas de seguimiento que puedes esperar
- ¿Y si no cambió nada recientemente y la causa no es obvia?
- ¿Cómo decides cuándo escalar o despertar a alguien más?
- ¿Cómo gestionas a un directivo que pide actualizaciones en mitad del incidente?
Más preguntas para Ingeniero DevOps
Tu entrevistador hará su propia versión de esta. Pega la descripción real del puesto en el Question Predictor gratuito y obtén las 20 preguntas que ese puesto tiene más probabilidades de hacerte, con lo que cada una busca en realidad.
Predecir mis preguntas