> tpl_ops_014
Hizmet Bağımlılık Haritası ve Kritiklik Kütüğü
Dağıtık mimariler genelinde doğrudan/geçişli çalışma zamanı bağımlılıklarını, senkron API bağlantılarını, asenkron kuyruk boru hatlarını, tek hata noktalarını (SPOF) ve kademeli çökme etki alanı sınırlarını kataloglayan çok katmanlı hizmet bağımlılık haritalama ve kritiklik sınıflandırma çalışma kitabı.
Yukarı/aşağı yönlü hizmet bağlantılarını, kritiklik katmanlarını (Tier 0-3) ve arıza etki yarıçaplarını haritalayan kapsamlı kütük.
Önemli Teknik Doküman Şablonu ve Hukuki Uyarı
TinyCTO.tv Teknik Doküman Şablon Bildirimi: Bu şablon genel eğitim ve operasyon amaçlı bir başlangıç materyalidir. Hukuki, vergisel, muhasebesel, yatırım, satın alma, mevzuat, güvenlik veya sertifikasyon danışmanlığı değildir. Gereklilikler ülkeye, kuruma, sözleşmeye ve riske göre değişir. Kullanmadan önce yetkin uzmanlarla gözden geçirip uyarlayın.
Çözülen Üretim Problemi
Karmaşık dağıtık sistemler, rutin bakım veya küçük kesintiler sırasında beklenmedik yıkıcı kademeli çökmeler yaşar; çünkü yukarı yönlü ekipler derin geçişli bağımlılıklar, gizli senkron veritabanı kilitleri ve tek hata noktalarından habersizdir.
Ne Zaman Kullanılmalı?
- •Mimari risk incelemeleri yürütürken ve mikro servisler genelinde gizli tek hata noktalarını (SPOF) tespit ederken
- •Canlı iş yüklerini Tier 0 (Görev Kritik) seviyesinden Tier 3 (Kritik Olmayan) seviyesine kadar net SLA hedefleriyle sınıflandırırken
- •Devre kesici kalıplarını, bölmeleme (bulkhead) sınırlarını ve kademeli bozulma (graceful degradation) mekanizmalarını tasarlarken
Ne Zaman Kullanılmamalı?
- •Bireysel altyapı sunucularını, donanım varlıklarını ve seri numaralarını takip ederken (CMDB donanım kütüğü kullanın)
- •Kod düzeyinde kütüphane bağımlılık yönetimi ve paket güvenlik açığı taramalarında (SBOM kütüğü TPL-SEC-011 kullanın)
5 Şablon Bölümü ve Yapısal İskelet
İş yüklerinin Tier 0 (Görev Kritik: >$50k/dk kesinti etkisi, sıkı %99,99 SLA), Tier 1 (İş Kritik), Tier 2 (Dahili/Operasyonel) ve Tier 3 (Kritik Olmayan Toplu İş) olarak net RTO/RPO hedefleriyle sınıflandırılması.
Senkron HTTP/gRPC bağlantılarının, asenkron Kafka/SQS kuyruklarının ve veritabanı okuma/yazmalarının zaman aşımı limitleri ve iş parçacığı havuzu yalıtımıyla kataloglanması.
Sistem genelinde kesintiye yol açabilecek paylaşılan veritabanı örneklerini, tek erişilebilirlik alanlarını, özel tedarikçi API'lerini ve merkezi kimlik doğrulama servislerini belirleme.
Yukarı yönlü kesintiler sırasında salt okunur önbellek yedekleri, asenkron kuyruk tamponlaması, sentetik sahte yanıtlar ve müşteriye dönük bakım bantlarının oluşturulması.
OpenTelemetry ve Datadog izlerinden otomatik servis haritası üretiminin entegrasyonu, Chaos Engineering bağımlılık koparma testlerinin planlanması ve sapma denetimi.
Doldurma ve Uygulama Yönergeleri
Bağımsız İnceleme ve Onay Kontrol Listesi
- Tüm zorunlu bölümler dolduruldu
- Gizli anahtar veya parola içermiyor
- Yönetici sponsor onayı alındı
Hizmet Bağımlılık Haritası ve Kritiklik Kütüğü - Örnek Vaka Analizi
Örnek Organizasyon: Küresel Dijital Bankacılık ve Ödeme Çekirdek Motoru
Küresel Dijital Bankacılık ve Ödeme Çekirdek Motoru için eksiksiz operasyonel uygulamayı gösteren gerçek dünya vaka analizi.
- •142 mikro servis haritalandı, 318 çalışma zamanı bağımlılığı kataloglandı ve ödeme sürecinde 4 kritik senkron SPOF tespit edildi
- •Kimlik doğrulama ve defter yazma için Tier 0 sınıflandırması belirlendi ve alt-saniye devre kesici kesintileri uygulandı
- •12 onaysız gölge veritabanı bağlantısını yakalayan otomatik OpenTelemetry grafik uyumlaması hayata geçirildi
Sıkça Sorulan Sorular
Doğrudan çalışma zamanı bağımlılığı ile geçişli bağımlılık arasındaki fark nedir?
Doğrudan bağımlılık, sisteminizin doğrudan çağırdığı bir servistir (ör. Servis A, REST ile Servis B'yi çağırır). Geçişli bağımlılık ise Servis B'nin dayandığı alt sistemdir (ör. Servis B, Veritabanı C'yi veya Üçüncü Taraf Sağlayıcı D'yi sorgular). Servis B Sağlayıcı D'yi zaman aşımları veya devre kesicilerle izole edemezse, Sağlayıcı D'deki bir kesinti zincirleme olarak Servis A'yı da çökertebilir.
Hizmet kritiklik katmanlaması mimari yatırımı nasıl belirler?
Tier 0 servisler çok bölgeli aktif-aktif dağıtım, sıfır-SPOF topolojisi, %99,99 erişilebilirlik ve otomatik arıza geçişi talep eder. Tier 1 tek bölgede çoklu AZ dağıtımı ve %99,9 erişilebilirlik ile çalışır. Tier 2 ve 3 servisler ise standart yedekleri ve bakım pencerelerini kabul ederek düşük etkili dahili araçlar için aşırı harcamayı önler.
Bağımlılık haritaları neden dağıtık izleme APM'leri ile sürekli denetlenmelidir?
Geliştiriciler kod güncellemeleri yayınladıkça, yeni SDK'ler ekledikçe veya paylaşılan veritabanlarını sorguladıkça statik dokümantasyon hızla eskir. OpenTelemetry veya Datadog'dan gelen dağıtık izleri sisteme beslemek, fiili çalışma zamanı trafiğini kayıtlı kütükle karşılaştırarak gölge bağımlılıkları kesinti yaşanmadan önce ortaya çıkarır.
Teknik Doküman Şablon Paketi
Giriş GerekliTüm boş şablonları, işlenmiş senaryoları ve doğrulama manifestolarını tek bir arşivde indirin.
Yetkili Standartlar ve Kaynaklar
- Google SRE Book: Addressing Cascading Failures in Distributed SystemsGoogle SRE • OFFICIAL REQUIREMENT
- ITIL 4 Practice Guide: Service Configuration ManagementAXELOS • OFFICIAL REQUIREMENT
- AWS Well-Architected Reliability Pillar: Mitigate Component FailuresAmazon Web Services • OFFICIAL REQUIREMENT
