Corta el daño inmediato limitando o pausando el job por lotes, y luego separa las cargas para que no puedan competir. Apunta el job a una réplica de lectura si es intensivo en lecturas, dale su propio pool de conexiones con un techo duro, y trocea el trabajo con pausas para que nunca monopolice la base de datos. A más largo plazo, reserva capacidad para el tráfico interactivo y alerta sobre la saturación del pool antes de que los usuarios lo noten.
Por qué lo preguntan los entrevistadores
Esta es una pregunta de aislamiento de recursos disfrazada de incidente. El entrevistador quiere mitigación inmediata seguida de un arreglo estructural, no solo un límite de conexiones más alto. Buscan si entiendes que subir el máximo de conexiones muchas veces empeora las cosas, y si sabes distinguir qué carga debe sacrificarse, ya que el camino interactivo es casi siempre el que hay que proteger.
Cómo estructurar tu respuesta
- Mitiga primero limitando o pausando el job culpable.
- Explica por qué subir sin más el límite de conexiones sale mal.
- Separa las cargas de forma estructural, réplicas y pools separados.
- Añade reserva de capacidad y aviso temprano de saturación.
Ejemplo de respuesta
Primero, parar la hemorragia. Pausa o limita el job por lotes, porque el camino interactivo es lo que sienten los clientes y el lote puede correr una hora después sin que a nadie le importe. El arreglo tentador es subir el máximo de conexiones, y eso normalmente lo empeora, ya que cada conexión tiene coste de memoria y de planificación y acabas con una base de datos dando tumbos en vez de una que solo está ocupada. Así que el arreglo real es el aislamiento. Si el job es intensivo en lecturas se mueve a una réplica de lectura, lo que quita la carga del primario por completo. Recibe sus propias credenciales y su propio pool con un techo duro, dimensionado para que incluso saturado del todo deje mucho margen a la API. Y el job en sí se trocea, así procesa por lotes con una pausa corta y un timeout de sentencia, en vez de una transacción enorme que retiene bloqueos y dispara el retraso de replicación. Luego la prevención: alertar sobre el uso del pool y las consultas largas en un umbral que salte antes de que sea visible para el usuario, así nos enteramos por la monitorización y no por los tickets de soporte.
¿Tienes esta entrevista a la vuelta de la esquina? GhostPilot escucha tu llamada en vivo, detecta la pregunta en cuanto la hacen y pone una respuesta estructurada en tu pantalla en tiempo real. Pruébalo en tu próxima entrevista de práctica, o coge un Session Pass de $29, sin suscripción, para la de verdad.
Mira cómo funcionaPreguntas de seguimiento que puedes esperar
- ¿Y si el job por lotes necesita escribir, así que una réplica no es opción?
- ¿Cómo dimensionarías los dos pools de conexiones?
- ¿Cómo cambia esto un pooler de conexiones delante de la base de datos?
Más preguntas para Ingeniero de nube
Tu entrevistador hará su propia versión de esta. Pega la descripción real del puesto en el Question Predictor gratuito y obtén las 20 preguntas que ese puesto tiene más probabilidades de hacerte, con lo que cada una busca en realidad.
Predecir mis preguntas