Hizmetler / SRE Services
Güvenilirliği şansa değil, mühendisliğe emanet edin
Sistemleriniz büyüdükçe güvenilirlik, kahramanlıkla değil disiplinle korunur. SLO'lara dayalı hata bütçesi yönetimi, olgun incident süreçleri ve kapasite mühendisliği ile kritik platformlarınızı ölçülebilir güvenilirlik hedeflerine taşıyoruz — 7/24 yönetilen SRE hizmeti veya ekibinize gömülü model ile.
- %65
- MTTR'da tipik iyileşme
- %99,99
- Yönettiğimiz kritik platformlarda uptime
- 7/24
- Takip-the-sun nöbet modeli
Yetkinlikler
Bu alanda neler yapıyoruz?
SLO ve Hata Bütçesi Tasarımı
İş etkisine dayalı SLI/SLO tanımları, hata bütçesi politikaları ve güvenilirlik ile geliştirme hızı arasındaki dengeyi yöneten karar mekanizmaları.
Incident Management
On-call tasarımı, eskalasyon zincirleri, incident komutanlığı pratiği ve suçlama içermeyen postmortem kültürünün kurulması.
Kapasite Planlama ve Performans
Yük testi, darboğaz analizi, otomatik ölçekleme stratejileri ve kampanya/yoğun dönem hazırlıkları için kapasite mühendisliği.
Yönetilen SRE (24/7)
Kritik platformlarınızın SLA'lı, 7/24 izlenmesi ve işletilmesi; aylık güvenilirlik raporları ve sürekli iyileştirme döngüsü.
Teknoloji Yığını
Üretimde deneyim sahibi olduğumuz teknolojiler
Araç seçimini ideoloji değil, mevcut yatırımınız ve hedef mimariniz belirler. Aşağıdaki teknolojilerin tamamında gerçek üretim ortamı deneyimimiz vardır; Red Hat Business Partner ve New Relic Certified Partner olarak OpenShift, RHEL, Ansible ve New Relic portföylerinde derinleşmiş bir ekibiz.
New Relic Observability Platformu
10 teknolojiNew Relic Certified Partner olarak APM, altyapı, log, tarayıcı/mobil izleme ve SLO yönetimini tek platformda kurup işletiyoruz; lisans ve veri hacmi optimizasyonunu da biz yönetiyoruz.
- New Relic APM & Distributed Tracing
- New Relic Infrastructure
- New Relic Logs
- New Relic Browser & Mobile
- New Relic Synthetics
- New Relic Alerts & Applied Intelligence (AIOps)
- New Relic Service Levels (SLO)
- NRQL & Dashboards
- New Relic Kubernetes / OpenShift entegrasyonu
- New Relic OpenTelemetry (OTLP) ingest
Metrik & Dashboard
5 teknoloji- Prometheus
- Thanos / Mimir
- Grafana
- Datadog
- Dynatrace
Log & Trace
5 teknoloji- Elastic Stack
- Grafana Loki
- OpenTelemetry
- Jaeger / Tempo
- Splunk
Incident & Nöbet Yönetimi
5 teknoloji- PagerDuty
- Opsgenie
- Grafana OnCall
- Statuspage
- Rootly / incident.io
Red Hat Operasyon Araçları
6 teknolojiRHEL ve OpenShift üzerindeki kritik iş yüklerini Red Hat'in kendi işletim araç setiyle yönetiyoruz.
- Red Hat Insights (öngörülü analitik)
- Red Hat Satellite (yama & yaşam döngüsü)
- Red Hat Ansible Automation Platform (self-healing runbook)
- Red Hat ACM Observability (çoklu küme)
- OpenShift Monitoring & Logging stack
- RHEL System Roles
Performans & Dayanıklılık
5 teknoloji- k6
- Gatling
- Chaos Mesh
- LitmusChaos
- Gremlin
SLO & Runbook Otomasyonu
4 teknoloji- Sloth / Pyrra
- OpenSLO
- Rundeck
- Backstage runbook plugin
Kanıt
Bu hizmetin sahadaki sonucu
Sık Sorulan Sorular
SRE Services hakkında
İki model de mümkün: kritik platformlarınızı 7/24 biz işletebiliriz ya da mühendislerimiz ekibinize gömülü çalışarak SRE pratiğini içeride kurar. Çoğu müşterimiz ikisinin karmasıyla başlar.
Hayır. Önce mevcut araçlarınızın üzerine SLO katmanı kurarız; araç değişikliği yalnızca somut bir kazanç varsa ve sizin kararınızla gündeme gelir.
Evet. New Relic Certified Partner olarak lisans temini, veri hacmi ve kullanıcı planlamasını yapıyor; APM, altyapı, log ve SLO yapılandırmasını kuruyor, alarm tasarımını ve NRQL dashboard'larını ekiplerinize devrediyoruz.
Hayır. OpenTelemetry tabanlı bir mimariyle mevcut metrik ve trace verinizi New Relic'e taşıyabilir ya da iki platformu birlikte işletebilirsiniz. Hangi verinin nerede duracağına maliyet, saklama süresi ve ekip alışkanlıklarına göre birlikte karar veriyoruz.
SRE Services yolculuğunuzu konuşalım
Mevcut durumunuzu dinleyip benzer kurumlardaki deneyimlerimizi paylaşacağımız 30 dakikalık bir keşif görüşmesiyle başlayalım.