Pregunta de entrevista para Ingeniero DevOps

¿Cómo fijas las peticiones y los límites de CPU y memoria para una carga de trabajo?

Qué evalúa el entrevistador, cómo estructurar tu respuesta y un ejemplo hablado que puedes adaptar.

Respuesta rápida

Fija las peticiones a partir del uso observado, normalmente alrededor de la mediana para CPU y cerca del pico para memoria, porque las peticiones gobiernan la planificación y la capacidad. Pon el límite de memoria cerca de la petición, ya que superarlo hace que maten el contenedor, y ve con cuidado con los límites de CPU porque provocan estrangulamiento que aparece como latencia inexplicable. Revisa los números con datos reales en vez de copiarlos entre servicios.

Por qué lo preguntan los entrevistadores

Esta es una pregunta práctica donde las respuestas equivocadas causan dolor real en producción, y el entrevistador probablemente tiene cicatrices. Quiere que sepas que la CPU es comprimible y la memoria no, que los límites de CPU provocan estrangulamiento en vez de una ralentización elegante, y que las peticiones determinan tanto la planificación como el coste del clúster. Mencionar las clases de calidad de servicio y cómo medir el uso demuestra profundidad.

Cómo estructurar tu respuesta

  • Explica que las peticiones gobiernan la planificación y los límites la imposición.
  • Separa CPU de memoria porque se comportan distinto.
  • Da un método para llegar a los números con datos reales.
  • Menciona el estrangulamiento, las muertes por falta de memoria y la calidad de servicio.

Ejemplo de respuesta

Ejemplo hablado, en primera persona

Las peticiones son lo que usa el planificador para colocar el pod y lo que en la práctica estás pagando, y los límites son el techo que impone el runtime. Los dos recursos se comportan de forma completamente distinta. La CPU es comprimible, así que tocar un límite de CPU significa que el contenedor queda estrangulado, y eso aparece como picos de latencia sin causa obvia, algo horrible de depurar. La memoria no es comprimible, así que superar el límite de memoria significa que el contenedor muere sin más. De ahí salen mis valores por defecto: fijo la petición de CPU a partir de la mediana de uso observada con algo de margen, y suelo ir con cuidado con los límites de CPU en servicios sensibles a la latencia, o los pongo generosos. Para la memoria pongo la petición cerca del pico realista y el límite cerca de ella, para que una fuga falle rápido y de forma visible en vez de comerse el nodo en silencio. Los números salen de un par de semanas de percentiles de uso real, no de copiar otro servicio, y los reviso después de las pruebas de carga. La otra cara es que las peticiones infladas son la razón principal de que los clústeres parezcan vacíos y aun así no puedan planificar nada.

¿Tienes esta entrevista a la vuelta de la esquina? GhostPilot escucha tu llamada en vivo, detecta la pregunta en cuanto la hacen y pone una respuesta estructurada en tu pantalla en tiempo real. Pruébalo en tu próxima entrevista de práctica, o coge un Session Pass de $29, sin suscripción, para la de verdad.

Mira cómo funciona

Preguntas de seguimiento que puedes esperar

  • ¿Qué le pasa a un pod cuando supera su límite de memoria?
  • ¿Por qué podrías omitir a propósito un límite de CPU?
  • ¿Cómo afectan las clases de calidad de servicio al orden de desalojo?

Más preguntas para Ingeniero DevOps

Tu entrevistador hará su propia versión de esta. Pega la descripción real del puesto en el Question Predictor gratuito y obtén las 20 preguntas que ese puesto tiene más probabilidades de hacerte, con lo que cada una busca en realidad.

Predecir mis preguntas

Ensaya las preguntas difíciles antes de que te las hagan

Practica con un copiloto en vivo y entra preparado. Un Session Pass de $29 te lleva a través de la entrevista sin suscripción y sin ataduras.

Consigue GhostPilot