DevOps, SRE & IT Operations · OpsPilot
Alert'ten aksiyona,
tek bir ChatOps workflow'unda.
OpsPilot, alert geldiği andan aksiyon tamamlanana kadar aynı context'i korur. Ekip logları inceler, uygun runbook'u çalıştırır, gerekiyorsa approval alır; kimin hangi environment'ta ne çalıştırdığı audit log'da kalır.
Alert → Approval → Execute
Günlük DevOps gerçeği
Alert başka yerde, log başka yerde,
aksiyon hâlâ terminalde.
Bir incident sırasında monitoring, terminal, jump server, Slack veya Teams ve wiki arasında gidip gelmek gerekiyor. Restart birkaç saniye sürebilir; doğru context'i bulmak, production erişimini almak ve sonradan ne yapıldığını çıkarmak çok daha uzun sürüyor.
Context araçlara dağılmış
Alert monitoring tool'unda, log başka ekranda, runbook wiki'de, aksiyon ise terminalde.
Rutin işler hâlâ SSH bekliyor
Basit bir health check veya service restart için bile jump server'a girip production erişimi olan birini beklemek gerekebiliyor.
Approval Slack mesajında kalıyor
“Çalıştırabiliriz” mesajı, hangi environment ve parametrenin onaylandığını birkaç gün sonra anlatmıyor.
Chat'ten aksiyona
Tek workflow,
baştan sona aynı context.
Sistemde değişiklik yapan her aksiyon çalıştırılmadan önce kullanıcı yetkisi, environment ve policy kontrolünden geçer.
Operatör chat üzerinden ne yapmak istediğini yazar: “payment-api health check” veya “staging'deki worker'ı restart et” gibi.
OpsPilot aksiyonu hemen çalıştırmaz; hedef environment'ı, kullanacağı tool'u ve adımları içeren bir plan çıkarır.
Plan; aksiyonun risk seviyesine, kullanıcı yetkisine ve ekibin tanımladığı policy'lere göre kontrol edilir.
Gerekli approval geldikten sonra ilgili MCP entegrasyonu veya bağlı tool aksiyonu çalıştırır.
Request, plan, approval, output ve aksiyonu çalıştıran kullanıcı aynı audit log içinde kalır.

Approval akışı aksiyonun riskine göre çalışır.
Read-only health check'ler otomatik çalışabilir. Bilinen restart'lar policy'ye göre ilerleyebilir. Service impact yaratacak değişiklikler approval bekler; data loss riski olan aksiyonlarda birden fazla approver isteyebilirsiniz. Kuralları her ekip kendi environment'ına göre tanımlar.

Alert'ten aksiyona aynı context ile ilerleyin.
Dashboard; active alert'leri, bekleyen approval'ları, son chat'leri, bağlı environment'ları ve service health bilgisini aynı yerde gösterir. Ekip incident'ı başka bir tool'da baştan anlatmadan incelemeye devam eder.

Alert history aksiyondan kopmasın.
Alert'leri site, service ve severity'ye göre filtreleyin; inceleme ve aksiyona aynı workflow üzerinden devam edin. Mute ayarları ve alert history operatörün önünde kalır.
Runbooks & Service Context
Runbook, incident sırasında
aranan doküman olmasın.
Runbook'lar, environment notları ve service owner bilgisi wiki, ticket ve kişilerin hafızasına dağılınca incident sırasında zaman kaybedilir. OpsPilot bu context'i service ile birlikte tutar; hem ekip hem de OpsPilot'ın planning katmanı aynı kaynaktan ilerler.
Runbook'lar
Tekrarlanan işleri copy-paste command'lerden çıkarıp parametreleri ve guardrail'leri belli runbook'lara dönüştürün.
Hizmetler
Service owner, environment, bağlı entegrasyon ve operasyon notlarını aynı service kaydında tutun.
Policies
Hangi aksiyonun otomatik çalışacağını, hangisinin approval veya birden fazla approver isteyeceğini tanımlayın.

AI çıktısını sadece “çalışıyor” diye production'a almayın.
Model veya prompt değiştiğinde smoke, safety ve golden testleri yeniden çalıştırın. Run history ve pass rate üzerinden iki sürümü karşılaştırın. Bu testler doğruluk garantisi vermez; davranış değişikliğini production'dan önce görmenizi sağlar.
Küçük bir PoC ile başlayın
Tek servis,
gerçek bir workflow.
İlk PoC'de bütün altyapıyı bağlamayın. Ekibin bugün manuel yürüttüğü bir health check, alert investigation, service restart veya approval gerektiren tek bir aksiyon yeterli.
Ekipte sık tekrarlanan, başlangıcı ve beklenen output'u belli gerçek bir workflow seçin.
Yalnızca gerekli service ve tool'ları minimum yetkiyle test veya staging environment'a bağlayın.
Workflow'u sunum üzerinde değil, bugün on-call olan DevOps veya SRE ekibiyle deneyin.
MTTR'ı, approval bekleme süresini, tool geçişlerini ve audit log'un yeterli olup olmadığını karşılaştırın; sonra kapsamı büyütüp büyütmeyeceğinize karar verin.
OpsPilot mevcut DevOps workflow'unuza uyuyor mu?
Tek bir servis ve gerçek bir aksiyon seçin; OpsPilot'ı kendi environment'ınızda birlikte deneyelim.