Permanent Fault — ta’mirlash, almashtirish yoki konfiguratsiyani tuzatishgacha davom etadigan barqaror nosozlik. U taqsimlangan tizimdagi aniq consistency, replication yoki fault-handling masalasini ifodalaydi. Kafolatlar faqat termin nomidan emas, protocol modeli, failure farazlari va implementatsiya hujjatidan aniqlanadi.
Modeldagi o‘rni
Buzilgan disk sektori, uzilgan kabel, ishdan chiqqan chip yoki doimiy noto‘g‘ri rule permanent fault bo‘lishi mumkin. Tizim redundancy orqali xizmatni boshqa komponentda davom ettiradi va nosoz resursni izolyatsiya qiladi.
Permanent Fault alohida algoritm yoki konfiguratsiya sifatida emas, client xulqi, storage persistence va tarmoq noaniqligi bilan birga ko‘riladi. Bir tugundagi muvaffaqiyat boshqa replica ham shu state’ni commit qilganini avtomatik anglatmaydi. Shu sabab acknowledgementning aniq ma’nosi va visible state chegarasi hujjatlashtiriladi.
Holat almashinuvi
Transient xato vaqt o‘tib yo‘qolishi mumkin, permanent xato esa bir xil sharoitda qayta kuzatiladi. Lekin tashqi simptom bir xil bo‘lishi mumkin; masalan timeout ham doimiy link uzilishi, ham qisqa congestiondan keladi.
Permanent Fault semantikasini baholashda normal execution bilan concurrent execution ajratiladi. Bitta client va bitta replica’da to‘g‘ri ko‘ringan algoritm parallel writer, retry yoki failoverda invariantni buzishi mumkin. Test tarixi invocation, response, version va replica identity bilan saqlansa, natijani formal modelga solishtirish mumkin.
Cheklovlar
Failoverdan keyin faulty component avtomatik qayta poolga kirmasligi kerak. Health check, quarantine, repair confirmation va data rebuild jarayoni xizmat holati bilan birga kuzatiladi.
Permanent Fault dizaynida safety va liveness ajratiladi. Safety buzilishi qarama-qarshi commit yoki noto‘g‘ri qiymatga, liveness buzilishi esa tizimning oldinga siljimasligiga olib keladi. Timeoutni qisqartirish livenessni tezlashtirishi mumkin, biroq sekin tarmoqda false failure va keraksiz leader almashishini oshiradi.
Ekspluatatsiya
Permanent Fault xavfsizlik nuqtai nazaridan ruxsatsiz state o‘zgarishi va replaydan himoyalanadi. Peer autentifikatsiyasi, message integrity, access-control va audit log birgalikda ishlaydi. Operator credentiali bilan data-plane yoki replication credentiali ajratiladi. Maxfiy qiymatlar trace va diagnostic dumpga nazoratsiz tushmasligi kerak.
Permanent Fault uchun upgrade va recovery bir xil protocol tarixini saqlashi kerak. Snapshotdan tiklangan node logning qaysi nuqtasigacha state borligini bildiradi va faqat undan keyingi entry’larni qabul qiladi. Eski formatdagi snapshot yangi binary tomonidan o‘qilishi yoki nazoratli migratsiya qilinishi sinovdan o‘tadi. Backup nusxasi boshqa failure domainida saqlanadi, lekin restore mashqi bo‘lmasa uning amaliy qiymati noma’lum qoladi. Recovery tugagach replica client trafikiga qo‘shilishidan oldin consistency checkdan o‘tadi.
Permanent Fault holatini kuzatishda configuration version, role yoki epoch, commit nuqtasi, queue va log ko‘rsatkichlari birlashtiriladi. Alert operator bajara oladigan tekshiruvga bog‘lanadi: qaysi node, qaysi key yoki transaction va qaysi vaqt oralig‘i ko‘rilishi aniq yoziladi. Aggregate dashboarddan keyin xom dalil bilan tasdiqlash noto‘g‘ri tashxisni kamaytiradi.
Permanent Faultga oid bahoni qayta ishlab bo‘lishi uchun test topologiyasi, software versiyasi, fault injection va kutilgan invariant saqlanadi. Yakuniy natija taxmin yoki bitta log satriga emas, bir-birini tasdiqlovchi state, history va o‘lchovlarga asoslanadi. Qabul qilingan cheklovlar ham natija bilan birga yozilib, boshqa workloadga ko‘r-ko‘rona ko‘chirilmaydi.
Bog‘liq tushunchalar
hardware failure, failover, redundancy, fault isolation, repair, transient fault