İçeriğe geç

Hizmetler / SRE Services

Güvenilirliği şansa değil, mühendisliğe emanet edin

Sistemleriniz büyüdükçe güvenilirlik, kahramanlıkla değil disiplinle korunur. SLO'lara dayalı hata bütçesi yönetimi, olgun incident süreçleri ve kapasite mühendisliği ile kritik platformlarınızı ölçülebilir güvenilirlik hedeflerine taşıyoruz — 7/24 yönetilen SRE hizmeti veya ekibinize gömülü model ile.

%65
MTTR'da tipik iyileşme
%99,99
Yönettiğimiz kritik platformlarda uptime
7/24
Takip-the-sun nöbet modeli

Yetkinlikler

Bu alanda neler yapıyoruz?

SLO ve Hata Bütçesi Tasarımı

İş etkisine dayalı SLI/SLO tanımları, hata bütçesi politikaları ve güvenilirlik ile geliştirme hızı arasındaki dengeyi yöneten karar mekanizmaları.

Incident Management

On-call tasarımı, eskalasyon zincirleri, incident komutanlığı pratiği ve suçlama içermeyen postmortem kültürünün kurulması.

Kapasite Planlama ve Performans

Yük testi, darboğaz analizi, otomatik ölçekleme stratejileri ve kampanya/yoğun dönem hazırlıkları için kapasite mühendisliği.

Yönetilen SRE (24/7)

Kritik platformlarınızın SLA'lı, 7/24 izlenmesi ve işletilmesi; aylık güvenilirlik raporları ve sürekli iyileştirme döngüsü.

Teknoloji Yığını

Üretimde deneyim sahibi olduğumuz teknolojiler

Araç seçimini ideoloji değil, mevcut yatırımınız ve hedef mimariniz belirler. Aşağıdaki teknolojilerin tamamında gerçek üretim ortamı deneyimimiz vardır; Red Hat Business Partner ve New Relic Certified Partner olarak OpenShift, RHEL, Ansible ve New Relic portföylerinde derinleşmiş bir ekibiz.

New Relic Observability Platformu

10 teknoloji

New Relic Certified Partner olarak APM, altyapı, log, tarayıcı/mobil izleme ve SLO yönetimini tek platformda kurup işletiyoruz; lisans ve veri hacmi optimizasyonunu da biz yönetiyoruz.

  • New Relic APM & Distributed Tracing
  • New Relic Infrastructure
  • New Relic Logs
  • New Relic Browser & Mobile
  • New Relic Synthetics
  • New Relic Alerts & Applied Intelligence (AIOps)
  • New Relic Service Levels (SLO)
  • NRQL & Dashboards
  • New Relic Kubernetes / OpenShift entegrasyonu
  • New Relic OpenTelemetry (OTLP) ingest

Metrik & Dashboard

5 teknoloji
  • Prometheus
  • Thanos / Mimir
  • Grafana
  • Datadog
  • Dynatrace

Log & Trace

5 teknoloji
  • Elastic Stack
  • Grafana Loki
  • OpenTelemetry
  • Jaeger / Tempo
  • Splunk

Incident & Nöbet Yönetimi

5 teknoloji
  • PagerDuty
  • Opsgenie
  • Grafana OnCall
  • Statuspage
  • Rootly / incident.io

Red Hat Operasyon Araçları

6 teknoloji

RHEL ve OpenShift üzerindeki kritik iş yüklerini Red Hat'in kendi işletim araç setiyle yönetiyoruz.

  • Red Hat Insights (öngörülü analitik)
  • Red Hat Satellite (yama & yaşam döngüsü)
  • Red Hat Ansible Automation Platform (self-healing runbook)
  • Red Hat ACM Observability (çoklu küme)
  • OpenShift Monitoring & Logging stack
  • RHEL System Roles

Performans & Dayanıklılık

5 teknoloji
  • k6
  • Gatling
  • Chaos Mesh
  • LitmusChaos
  • Gremlin

SLO & Runbook Otomasyonu

4 teknoloji
  • Sloth / Pyrra
  • OpenSLO
  • Rundeck
  • Backstage runbook plugin

Sık Sorulan Sorular

SRE Services hakkında

İki model de mümkün: kritik platformlarınızı 7/24 biz işletebiliriz ya da mühendislerimiz ekibinize gömülü çalışarak SRE pratiğini içeride kurar. Çoğu müşterimiz ikisinin karmasıyla başlar.

SRE Services yolculuğunuzu konuşalım

Mevcut durumunuzu dinleyip benzer kurumlardaki deneyimlerimizi paylaşacağımız 30 dakikalık bir keşif görüşmesiyle başlayalım.