Kurzfristig den Betrieb wiederherstellen: den neuen Namen im Staging Layer mappen, die betroffenen Partitionen neu laufen lassen und prüfen, dass die nachgelagerten Zahlen stimmen. Langfristig hör auf, dich auf gutes Zureden zu verlassen. Führ einen Data Contract mit dem Quellteam ein, validier das Schema beim Ingest, damit Fehler an der Grenze mit klarer Meldung auftreten, und lande rohe Payloads untypisiert, damit ein Umbenennen den Ingestion-Pfad nicht zerstört.
Warum Interviewer das fragen
Interviewer wollen sowohl Incident Response als auch systemisches Denken sehen, plus wie du über Teamgrenzen hinweg arbeitest. Die stärksten Antworten schieben die Schuld nicht auf das vorgelagerte Team, sondern bauen Verteidigung: Schema-Validierung am Rand, Contracts mit Alerting und einen änderungsresistenten Raw Layer. Sie wollen außerdem, dass du prüfst, wer sonst noch von dieser Quelle abhängt.
So baust du deine Antwort auf
- Fix nach vorne im Staging Layer und lass betroffene Partitionen neu laufen.
- Prüf, wer die Quelle sonst konsumiert, und warne sie.
- Verschieb die Schema-Validierung an die Ingestion-Grenze.
- Schlag einen Data Contract mit Versionierung und Vorlaufzeiten vor.
- Mach den Raw Layer tolerant, damit Ingestion an einem Rename nie scheitert.
Beispielantwort
Sofort ist es ein kleiner Fix: die neue Spalte im Staging-Modell aliasen, die betroffenen Partitionen neu laufen lassen und ein paar vertraute Aggregate abstimmen, damit ich weiß, dass sich nicht still auch die Bedeutung geändert hat und nicht nur der Name. Ich schaue außerdem im Katalog nach weiteren Konsumenten dieser Tabelle, denn wenn es uns zerlegt hat, hat es wahrscheinlich noch jemanden zerlegt, der es nur noch nicht gemerkt hat. Dann der systemische Teil. Mir ist lieber, der Fehler passiert beim Ingest mit einer Meldung wie erwartete Spalte customer_id, gefunden customer_identifier, als drei Modelle später mit einer Null-Spalte. Also wandert die Schema-Validierung an die Grenze, und der Raw Layer speichert das Payload wie es ist, wodurch Ingestion weiterläuft und nur die typisierte Schicht meckert. Und ich würde mit dem Quellteam reden, nicht um zu klagen, sondern um einen Contract aufzusetzen: das sind die Felder, von denen wir abhängen, das ist das Alerting, bitte gebt uns eine Release-Ankündigung. Das haben wir bei meiner letzten Station gemacht, und aus einem wiederkehrenden 6-Uhr-Problem wurde eine Slack-Nachricht eine Woche vorher.
Steht dieses Vorstellungsgespräch bald an? GhostPilot hört bei deinem Live-Call mit, erkennt die Frage in dem Moment, in dem sie gestellt wird, und bringt dir eine strukturierte Antwort in Echtzeit auf den Bildschirm. Probier es im nächsten Mock aus, oder hol dir einen $29 Session Pass, kein Abo, für den Ernstfall.
So funktioniert esNachfragen, mit denen du rechnen solltest
- Was gehört in einen Data Contract, und wer setzt ihn durch?
- Wie erkennst du eine semantische Änderung, bei der der Name gleich bleibt?
- Wie versionierst du eine Tabelle, damit Konsumenten schrittweise migrieren können?
Weitere Fragen für Data Engineer
Dein Interviewer stellt seine eigene Version davon. Kopier deine echte Stellenbeschreibung in den kostenlosen Question Predictor und bekomm die 20 Fragen, die diese Rolle am wahrscheinlichsten stellt, samt dem, worauf jede wirklich abzielt.
Meine Fragen vorhersagen