Yazılım'ya dön
Yazılım
Mikroservis Gözlemlenebilirlik Mimarisi için Claude Promptu
Optimal modelClaude
Zorlukİleri
KategoriYazılım
Varyant3 adet
prompt.txt
Sen deneyimli bir Site Reliability Engineer (SRE) ve Platform Engineering uzmanısın. Aşağıda tarif edilen {mimari_tanim} için kapsamlı bir gözlemlenebilirlik (observability) mimarisi tasarla ve adım adım kurulum planı hazırla.
## Proje Bağlamı
- Uygulama: {uygulama_adi} ({servis_sayisi} mikroservis)
- Dil/Runtime: {teknoloji_yigini} (örn. Node.js + Python + Go)
- Orkestrasyon: {orkestrasyon} (Kubernetes / Docker Compose / ECS)
- Mevcut altyapı: {mevcut_altyapi} (örn. AWS EKS, bare-metal, GKE)
- Takım büyüklüğü: {takim_buyuklugu} geliştirici
- SLO hedefleri: {slo_hedefleri} (örn. %99.9 uptime, p95 latency < 200ms)
## Görevler (sırasıyla uygula):
### 1. Gözlemlenebilirlik Olgunluk Değerlendirmesi
- Mevcut durumu "Monitoring Maturity Model" çerçevesinde değerlendir (Seviye 0-4)
- En kritik 3 kör noktayı (blind spot) tespit et
- Hızlı kazanım (quick win) önerileri sun (bu hafta uygulanabilecek)
### 2. Üç Sütun Mimarisini Tasarla (Metrics / Traces / Logs)
**Metrikler (Metrics):**
- Prometheus scrape konfigürasyonu ({servis_sayisi} servis için)
- Her servis için RED metrikler (Rate, Errors, Duration) + USE metrikler (Utilization, Saturation, Errors) tanımla
- Custom business metric önerileri (örn. siparis_basarisizlik_orani, odeme_gecikme_ms)
- Recording rules ve alerting rules yaz (YAML formatında, PromQL ile)
**Dağıtık İzleme (Distributed Tracing):**
- OpenTelemetry SDK entegrasyon kodu ({teknoloji_yigini} için, çalışır hâlde)
- Trace sampling stratejisi (head-based vs tail-based, örnekleme oranı ve gerekçesi)
- Kritik servis bağımlılık haritası (hangi servis hangini çağırıyor, Mermaid diyagramı)
- Jaeger veya Tempo konfigürasyonu (Helm values.yaml)
**Merkezi Loglama (Centralized Logging):**
- Structured logging standardı (JSON şeması + zorunlu alanlar: service, trace_id, span_id, level, message, timestamp)
- Log aggregation pipeline: Fluent Bit → Loki veya Elasticsearch
- Log retention ve maliyet optimizasyon politikası (hot/warm/cold tier)
### 3. Alerting & On-Call Stratejisi
- Alert severity seviyeleri tanımla: P1 (kritik, 5 dk), P2 (yüksek, 30 dk), P3 (düşük, iş saatleri)
- {servis_sayisi} servis için hazır alerting kuralları yaz (PromQL formatında, kopyala-yapıştır çalışır)
- Alert yorgunluğu (alert fatigue) önleme stratejisi ve inhibition rules
- Escalation policy ve nöbet rotasyonu önerisi (PagerDuty / Opsgenie yapılandırması)
### 4. Grafana Dashboard Tasarımı
- Her servis için zorunlu panel listesi (RED dashboard template, JSON olarak)
- İş (business) KPI dashboard'u için panel önerileri
- Fleet Overview dashboard (tüm {servis_sayisi} servis tek ekranda, semafor renk kodlaması)
### 5. Altyapı Kurulum Planı
- Helm chart listesi (monitoring stack) + values.yaml kritik parametreleri
- Kubernetes resource requests/limits (Prometheus, Grafana, Jaeger/Tempo için)
- Yüksek erişilebilirlik (HA) konfigürasyonu (replica count, anti-affinity rules)
- Tahmini altyapı maliyeti ({mevcut_altyapi} üzerinde aylık, tablo formatında)
### 6. Kademeli Uygulama Takvimi
{takim_buyuklugu} kişilik takım için 8 haftalık sprint planı hazırla:
- Sprint 1-2: Temel metrikler + alerting (Prometheus + Grafana + ilk 10 kural)
- Sprint 3-4: Dağıtık izleme entegrasyonu (OpenTelemetry + Tempo/Jaeger)
- Sprint 5-6: Merkezi loglama + dashboard'lar (Fluent Bit + Loki + Grafana)
- Sprint 7-8: On-call olgunlaştırma + maliyet optimizasyonu
## Kısıtlar
- Vendor lock-in'den kaçın; mümkün olduğunda açık kaynak çözümleri tercih et (Prometheus > CloudWatch)
- GDPR/KVKK uyumluluğu için PII içeren log alanlarını maskele (e-posta, TC kimlik no, kredi kartı)
- Tüm kod örneklerini çalışır hâlde yaz (gerçek konfigürasyon; "your-value-here" tarzı placeholder yok)
- Her öneride "neden" sorusunu yanıtla; alternatifleri karşılaştır
## Çıktı Formatı
1. **Mimari Diyagram** (Mermaid ile servis → observability stack akışını göster)
2. **Kod Dosyaları** (her dosya için başlık + içerik bloğu, dil etiketli)
3. **Alerting Kuralları** (YAML, PromQL, kopyala-yapıştır hazır)
4. **Uygulama Takvimi** (markdown tablosu: hafta / hedef / çıktı / sorumlu)
5. **Maliyet Tahmini** (tablo: bileşen / boyut / aylık maliyet)
6. **Sonraki Adımlar** (öncelikli madde listesi, bu haftadan başla)Bu ne işe yarar?
Claude ile mikroservis gözlemlenebilirlik mimarisi tasarla. Prometheus, Grafana, OpenTelemetry, Loki + alerting ve on-call stratejisi.