उसे multi availability zone चलाएं, ताकि दूसरे zone में एक synchronous standby रहे और failover अपने आप हो, आमतौर पर एक दो मिनट के भीतर। read replica read scaling के लिए हैं, availability के लिए नहीं, क्योंकि replication asynchronous है और पीछे रह सकती है। उसके साथ automated backup और point in time recovery रखें, cluster endpoint या किसी proxy से connect करें ताकि failover संभल जाए, और failover पर भरोसा करने के बजाय उसे सचमुच टेस्ट करें।
इंटरव्यूअर यह क्यों पूछते हैं
इंटरव्यूअर availability और durability का फर्क चाहता है और साथ में वह बेहद आम गलतफहमी भी कि read replica कोई failover target है। वे यह भी देखते हैं कि failover के दौरान application के साथ क्या होता है, क्योंकि DNS caching और connection pool ऐसे outage पैदा करते हैं जो असली database वाली घटना से ज्यादा देर चलते हैं। failover को जानबूझकर टेस्ट करना वह जवाब है जो असली ऑपरेशनल अनुभव दिखाता है।
अपना जवाब कैसे स्ट्रक्चर करें
- शुरू में ही availability, durability और read scaling अलग करें।
- synchronous standby और अपने आप होने वाला failover बताएं।
- समझाएं कि failover के दौरान application को क्या करना चाहिए।
- backup, recovery की टेस्टिंग और cross region copy कवर करें।
उदाहरण जवाब
multi availability zone इसका मूल है: दूसरे zone में एक synchronous standby, और primary के फेल होने पर managed service उसे promote कर देती है, आमतौर पर एक दो मिनट के भीतर। जो फर्क मैं हमेशा साफ करता हूं वह यह है कि read replica failover target नहीं है, वह asynchronous है, तो उसे promote करने का मतलब हाल के कुछ write खोना हो सकता है; वह read scale के लिए है। durability फिर से अलग चीज है, तो automated backup साथ में point in time recovery, और मैं उन्हें दूसरे region में copy करता हूं क्योंकि जो highly available database सिर्फ एक region में मौजूद है वह अब भी एक बुरे दिन की दूरी पर है। जो हिस्सा लोग भूल जाते हैं वह application है। failover बदल देता है कि endpoint किस host की तरफ इशारा कर रहा है, तो बासी connection पकड़े हुए कोई pool या हमेशा के लिए DNS cache करने वाला कोई runtime database के ठीक हो जाने के बाद भी फेल होता रहेगा। इसलिए मैं cluster endpoint या proxy से connect करता हूं, समझदारी भरा pool validation रखता हूं, और यह पक्का करता हूं कि retry सुरक्षित हों। और मैं उसे टेस्ट करता हूं, किसी निचले environment में failover चलाकर और यह नापकर कि application को उबरने में कितना वक्त लगता है, क्योंकि वह नंबर हमेशा विज्ञापित नंबर से बुरा होता है।
जल्दी ही यह इंटरव्यू देने जा रहे हैं? GhostPilot आपकी लाइव कॉल सुनता है, सवाल पूछे जाते ही उसे पकड़ लेता है, और रियल-टाइम में एक स्ट्रक्चर्ड जवाब आपकी स्क्रीन पर डाल देता है। अगले मॉक में इसे आजमाएं, या ले लें एक $29 Session Pass, कोई सब्सक्रिप्शन नहीं, असली इंटरव्यू के लिए।
देखें यह कैसे काम करता हैफॉलो-अप सवाल जिनकी उम्मीद रखें
- asynchronous replication के साथ आपका recovery point objective क्या है?
- failover के बाद आने वाले connection storm आप कैसे संभालते हैं?
- दूसरे region के read replica को आप कब promote करेंगे?
क्लाउड इंजीनियर के और सवाल
आपका इंटरव्यूअर इसका अपना वर्ज़न पूछेगा। फ्री Question Predictor में अपना असली जॉब डिस्क्रिप्शन पेस्ट कीजिए और वो 20 सवाल पाइए जो उस रोल में सबसे ज्यादा पूछे जाने की संभावना है, साथ में यह भी कि हर सवाल असल में क्या टटोल रहा है।
मेरे सवाल प्रेडिक्ट करें