A corto plazo, restaura el servicio: mapea el nombre nuevo en la capa de staging, reejecuta las particiones afectadas y confirma que los números aguas abajo cuadran. A largo plazo, deja de depender de la buena voluntad. Introduce un contrato de datos con el equipo origen, valida el esquema en la ingesta para que los fallos se detecten en la frontera con un mensaje claro, y aterriza los payloads crudos sin tipar para que un renombrado no destruya la propia ruta de ingesta.
Por qué lo preguntan los entrevistadores
Los entrevistadores quieren ver a la vez respuesta a incidentes y pensamiento sistémico, además de cómo trabajas cruzando fronteras de equipo. Las mejores respuestas evitan culpar al equipo de origen y en su lugar construyen defensas: validación de esquema en el borde, contratos con alertas y una capa cruda resistente al cambio. También quieren que compruebes si otros pipelines comparten esa dependencia.
Cómo estructurar tu respuesta
- Arregla hacia delante en la capa de staging y reejecuta las particiones afectadas.
- Comprueba quién más consume ese origen y avísale.
- Mueve la validación de esquema a la frontera de ingesta.
- Propón un contrato de datos con versionado y plazos de aviso.
- Haz la capa cruda tolerante para que la ingesta nunca falle por un renombrado.
Ejemplo de respuesta
De inmediato es un arreglo pequeño: pongo un alias a la columna nueva en el modelo de staging, reejecuto las particiones afectadas y reconcilio un par de agregados de confianza para saber que nada cambió de significado además de nombre. También reviso el catálogo por si hay otros consumidores de esa tabla, porque si nos rompió a nosotros probablemente rompió a alguien más que aún no se ha dado cuenta. Luego viene la parte sistémica. Prefiero que el fallo ocurra en la ingesta con un mensaje que diga se esperaba la columna customer_id, se encontró customer_identifier, y no tres modelos más abajo con una columna nula. Así que la validación de esquema se mueve a la frontera, y la capa cruda guarda el payload tal cual, lo que significa que la ingesta sigue funcionando y solo se queja la capa tipada. Y hablaría con el equipo origen, no para quejarme sino para montar un contrato: estos son los campos de los que dependemos, estas son las alertas, avisadnos antes de publicar. Eso hicimos en mi trabajo anterior y convirtió un problema recurrente de las 6 de la mañana en un mensaje de Slack con una semana de antelación.
¿Tienes esta entrevista a la vuelta de la esquina? GhostPilot escucha tu llamada en vivo, detecta la pregunta en cuanto la hacen y pone una respuesta estructurada en tu pantalla en tiempo real. Pruébalo en tu próxima entrevista de práctica, o coge un Session Pass de $29, sin suscripción, para la de verdad.
Mira cómo funcionaPreguntas de seguimiento que puedes esperar
- ¿Qué debe contener un contrato de datos y quién lo hace cumplir?
- ¿Cómo detectarías un cambio semántico donde el nombre se mantiene igual?
- ¿Cómo versionas una tabla para que los consumidores migren poco a poco?
Más preguntas para Ingeniero de datos
Tu entrevistador hará su propia versión de esta. Pega la descripción real del puesto en el Question Predictor gratuito y obtén las 20 preguntas que ese puesto tiene más probabilidades de hacerte, con lo que cada una busca en realidad.
Predecir mis preguntas