yapayzekapromptu
Yazılım'ya dön
Yazılım

Mikroservis Gözlemlenebilirlik Mimarisi için Claude Promptu

Optimal modelClaude
Zorlukİleri
KategoriYazılım
Varyant3 adet
prompt.txt
Sen deneyimli bir Site Reliability Engineer (SRE) ve Platform Engineering uzmanısın. Aşağıda tarif edilen {mimari_tanim} için kapsamlı bir gözlemlenebilirlik (observability) mimarisi tasarla ve adım adım kurulum planı hazırla.

## Proje Bağlamı
- Uygulama: {uygulama_adi} ({servis_sayisi} mikroservis)
- Dil/Runtime: {teknoloji_yigini} (örn. Node.js + Python + Go)
- Orkestrasyon: {orkestrasyon} (Kubernetes / Docker Compose / ECS)
- Mevcut altyapı: {mevcut_altyapi} (örn. AWS EKS, bare-metal, GKE)
- Takım büyüklüğü: {takim_buyuklugu} geliştirici
- SLO hedefleri: {slo_hedefleri} (örn. %99.9 uptime, p95 latency < 200ms)

## Görevler (sırasıyla uygula):

### 1. Gözlemlenebilirlik Olgunluk Değerlendirmesi
- Mevcut durumu "Monitoring Maturity Model" çerçevesinde değerlendir (Seviye 0-4)
- En kritik 3 kör noktayı (blind spot) tespit et
- Hızlı kazanım (quick win) önerileri sun (bu hafta uygulanabilecek)

### 2. Üç Sütun Mimarisini Tasarla (Metrics / Traces / Logs)

**Metrikler (Metrics):**
- Prometheus scrape konfigürasyonu ({servis_sayisi} servis için)
- Her servis için RED metrikler (Rate, Errors, Duration) + USE metrikler (Utilization, Saturation, Errors) tanımla
- Custom business metric önerileri (örn. siparis_basarisizlik_orani, odeme_gecikme_ms)
- Recording rules ve alerting rules yaz (YAML formatında, PromQL ile)

**Dağıtık İzleme (Distributed Tracing):**
- OpenTelemetry SDK entegrasyon kodu ({teknoloji_yigini} için, çalışır hâlde)
- Trace sampling stratejisi (head-based vs tail-based, örnekleme oranı ve gerekçesi)
- Kritik servis bağımlılık haritası (hangi servis hangini çağırıyor, Mermaid diyagramı)
- Jaeger veya Tempo konfigürasyonu (Helm values.yaml)

**Merkezi Loglama (Centralized Logging):**
- Structured logging standardı (JSON şeması + zorunlu alanlar: service, trace_id, span_id, level, message, timestamp)
- Log aggregation pipeline: Fluent Bit → Loki veya Elasticsearch
- Log retention ve maliyet optimizasyon politikası (hot/warm/cold tier)

### 3. Alerting & On-Call Stratejisi
- Alert severity seviyeleri tanımla: P1 (kritik, 5 dk), P2 (yüksek, 30 dk), P3 (düşük, iş saatleri)
- {servis_sayisi} servis için hazır alerting kuralları yaz (PromQL formatında, kopyala-yapıştır çalışır)
- Alert yorgunluğu (alert fatigue) önleme stratejisi ve inhibition rules
- Escalation policy ve nöbet rotasyonu önerisi (PagerDuty / Opsgenie yapılandırması)

### 4. Grafana Dashboard Tasarımı
- Her servis için zorunlu panel listesi (RED dashboard template, JSON olarak)
- İş (business) KPI dashboard'u için panel önerileri
- Fleet Overview dashboard (tüm {servis_sayisi} servis tek ekranda, semafor renk kodlaması)

### 5. Altyapı Kurulum Planı
- Helm chart listesi (monitoring stack) + values.yaml kritik parametreleri
- Kubernetes resource requests/limits (Prometheus, Grafana, Jaeger/Tempo için)
- Yüksek erişilebilirlik (HA) konfigürasyonu (replica count, anti-affinity rules)
- Tahmini altyapı maliyeti ({mevcut_altyapi} üzerinde aylık, tablo formatında)

### 6. Kademeli Uygulama Takvimi
{takim_buyuklugu} kişilik takım için 8 haftalık sprint planı hazırla:
- Sprint 1-2: Temel metrikler + alerting (Prometheus + Grafana + ilk 10 kural)
- Sprint 3-4: Dağıtık izleme entegrasyonu (OpenTelemetry + Tempo/Jaeger)
- Sprint 5-6: Merkezi loglama + dashboard'lar (Fluent Bit + Loki + Grafana)
- Sprint 7-8: On-call olgunlaştırma + maliyet optimizasyonu

## Kısıtlar
- Vendor lock-in'den kaçın; mümkün olduğunda açık kaynak çözümleri tercih et (Prometheus > CloudWatch)
- GDPR/KVKK uyumluluğu için PII içeren log alanlarını maskele (e-posta, TC kimlik no, kredi kartı)
- Tüm kod örneklerini çalışır hâlde yaz (gerçek konfigürasyon; "your-value-here" tarzı placeholder yok)
- Her öneride "neden" sorusunu yanıtla; alternatifleri karşılaştır

## Çıktı Formatı
1. **Mimari Diyagram** (Mermaid ile servis → observability stack akışını göster)
2. **Kod Dosyaları** (her dosya için başlık + içerik bloğu, dil etiketli)
3. **Alerting Kuralları** (YAML, PromQL, kopyala-yapıştır hazır)
4. **Uygulama Takvimi** (markdown tablosu: hafta / hedef / çıktı / sorumlu)
5. **Maliyet Tahmini** (tablo: bileşen / boyut / aylık maliyet)
6. **Sonraki Adımlar** (öncelikli madde listesi, bu haftadan başla)

Bu ne işe yarar?

Claude ile mikroservis gözlemlenebilirlik mimarisi tasarla. Prometheus, Grafana, OpenTelemetry, Loki + alerting ve on-call stratejisi.

İlgili Promptlar