Állás · Senior

Site Reliability Engineer

DevOps / SRE • Senior • Remote • Teljes munkaidő Spanyolország Spanyolország

A HostPapa CloudBlue üzletága Site Reliability Engineert keres, aki a többbérlős SaaS platformok megbízhatóságáért, skálázhatóságáért és megfigyelhetőségéért felel, szoros együttműködésben a DevOps, Platform és fejlesztői csapatokkal.

Feladatok

  • SLI-k, SLO-k és hibaköltségvetések meghatározása kritikus szolgáltatásokhoz
  • Rendszerarchitektúra alakítása megbízhatóság, skálázhatóság és üzemeltethetőség szempontjából
  • Operatív terhek csökkentése automatizálással
  • Observability stack tervezése és üzemeltetése (Datadog, Grafana, Elastic Stack)
  • Riasztási stratégiák és dashboardok kialakítása
  • Magas rendelkezésre állású architektúrák tervezése: redundancia, failover, katasztrófa utáni helyreállítás
  • Kapacitástervezés, terheléses tesztelés, teljesítményoptimalizálás
  • Vezető szerep éles incidensek kezelésében
  • Post-mortem elemzések vezetése, fejlesztések meghatározása
  • Kubernetes-alapú platformok megbízhatóságának javítása
  • Együttműködés a deployment biztonságának és a rollback-stratégiáknak a javításában
  • Runbookok és üzemeltetési dokumentáció karbantartása

Elvárások

  • 3+ év tapasztalat SRE, DevOps mérnök vagy production engineer szerepben
  • Tapasztalat magas rendelkezésre állású, többbérlős SaaS platformok üzemeltetésében
  • Gyakorlati tapasztalat observability és monitoring eszközökkel (Datadog, Grafana, Elasticsearch/Kibana)
  • Linux, hálózatok és elosztott rendszerek alapos ismerete
  • Konténerizált környezetekben szerzett tapasztalat

Soft skillek

Incidenskezelési vezetői készségKommunikáció csapatok közöttProaktív problémamegoldás

A munkáltatóról

A HostPapa 39 országban jelen lévő, gyorsan növekvő webtárhely-szolgáltató. CloudBlue üzletága nagy Telco-k, disztribútorok és MSP-k számára biztosít felhőalapú kereskedelmi platformot.

Hasonló állások