Un SLI es una medición de la experiencia del usuario, como la proporción de peticiones servidas con éxito por debajo de trescientos milisegundos. Un SLO es el objetivo para esa medición en una ventana, digamos el 99,9 por ciento sobre veintiocho días. El presupuesto de error es lo que sobra, así que el 99,9 por ciento deja unos cuarenta y tres minutos de fallo al mes. Cuando el presupuesto está sano publicas más rápido; cuando está gastado, el trabajo de fiabilidad tiene prioridad.
Por qué lo preguntan los entrevistadores
Esta pregunta comprueba si sabes conectar la fiabilidad con las decisiones de negocio en vez de perseguir uptime por el uptime. El entrevistador quiere ver que eliges indicadores desde el punto de vista del usuario, que sabes que el cien por cien es el objetivo equivocado y, a ser posible, que sabes describir alertas por tasa de consumo en lugar de avisar en cada incumplimiento del umbral.
Cómo estructurar tu respuesta
- Define los tres términos con limpieza y con un número concreto.
- Explica por qué el presupuesto hace explícito el compromiso.
- Describe cómo cambia el presupuesto el comportamiento del equipo en la práctica.
- Menciona las alertas por tasa de consumo frente a las de umbral en crudo.
Ejemplo de respuesta
El indicador es lo que mides desde el lado del usuario, así que para una API suele ser la proporción de peticiones que son a la vez correctas y lo bastante rápidas. El objetivo es la meta sobre una ventana móvil, y el presupuesto es lo que sobra. Tres nueves sobre veintiocho días son unos cuarenta y tres minutos de mal servicio que puedes gastar, y plantearlo como presupuesto es justo la clave, porque convierte la fiabilidad de una discusión en una cuenta. Si hemos gastado un cinco por ciento del presupuesto este mes, publicamos funcionalidades y asumimos riesgos razonables. Si hemos quemado el ochenta por ciento para el día diez, el siguiente sprint es trabajo de fiabilidad y los lanzamientos arriesgados esperan. Para las alertas uso tasas de consumo en varias ventanas en vez de avisar en cuanto la ratio baja, así que un consumo rápido que agotaría el presupuesto en una hora avisa de inmediato, mientras que un consumo lento crea un ticket. Eso mató casi todo nuestro ruido nocturno. La parte más difícil es elegir el indicador con honestidad, porque un objetivo sobre algo que los usuarios no pueden notar es puro teatro.
¿Tienes esta entrevista a la vuelta de la esquina? GhostPilot escucha tu llamada en vivo, detecta la pregunta en cuanto la hacen y pone una respuesta estructurada en tu pantalla en tiempo real. Pruébalo en tu próxima entrevista de práctica, o coge un Session Pass de $29, sin suscripción, para la de verdad.
Mira cómo funcionaPreguntas de seguimiento que puedes esperar
- ¿Cómo elegirías un SLI para un pipeline de procesamiento por lotes asíncrono?
- ¿Qué haces cuando la caída de una dependencia quema tu presupuesto?
- ¿Cómo fijas el primer objetivo cuando no tienes datos históricos?
Más preguntas para Ingeniero DevOps
Tu entrevistador hará su propia versión de esta. Pega la descripción real del puesto en el Question Predictor gratuito y obtén las 20 preguntas que ese puesto tiene más probabilidades de hacerte, con lo que cada una busca en realidad.
Predecir mis preguntas