Állás · Senior

Senior SRE / Felhőmérnök

Cloud Engineer • Senior • Remote • Teljes munkaidő Ukrajna Ukrajna

Tapasztalt SRE / felhőmérnököt keresnek, aki erős gyakorlati tapasztalattal rendelkezik éles felhő-infrastruktúra üzemeltetésében, fókuszban a megbízhatósággal, incidenskezeléssel, automatizálással és megfigyelhetőséggel.

Feladatok

  • Éles felhő-infrastruktúra üzemeltetése, karbantartása és fejlesztése AWS, Azure, GCP, Windows vagy hibrid környezetekben
  • Monitoring, logging, metrikák, tracing, dashboardok és riasztások építése és karbantartása
  • Megfigyelhetőségi lefedettség javítása infrastruktúrán, alkalmazásokon, adatbázisokon és hálózati függőségeken
  • Riasztások hangolása a zajszint csökkentésére és a jelminőség javítására
  • Részvétel incidenskezelésben, hibaelhárításban, gyökérok-elemzésben és utóelemzésben
  • Automatizálás építése infrastruktúra-műveletekhez, telepítésekhez, health checkekhez és runbookokhoz
  • Együttműködés mérnöki csapatokkal SLO/SLI/error budget és üzemeltetési készenléti sztenderdek meghatározásában
  • Felhő-hálózat, DNS, TLS, load balancing, IAM, tárolás és compute üzemeltetésének támogatása
  • Infrastructure as Code és konfigurációkezelési gyakorlatok fenntartása
  • Runbookok, üzemeltetési dokumentáció és eszkalációs eljárások készítése
  • Termelési kockázatok azonosítása és elhárítása automatizálással és architektúra-fejlesztéssel

Elvárások

  • Gyakorlati éles felhő-infrastruktúra tapasztalat
  • Erős tapasztalat AWS, GCP, Windows és/vagy hibrid felhőkörnyezetekkel
  • Tapasztalat megfigyelhetőségi, monitoring, logging, dashboard és riasztási rendszerek építésében
  • Erős hibaelhárítási készség infrastruktúra, hálózat, alkalmazás és felhőszolgáltatás rétegeken
  • Linux rendszerek, hálózati alapok, DNS, TLS, IAM, load balancerek, tárolás és compute ismerete
  • Infrastructure as Code tapasztalat Terraform, CloudFormation vagy Pulumi eszközökkel
  • Szkriptelési és automatizálási készség Bash, Python vagy Go nyelven
  • Tapasztalat termelési incidenskezelésben és postmortem folyamatokban
  • SRE gyakorlatok ismerete (SLO, SLI, error budget, toil-csökkentés, üzemeltetési készenlét)
  • Szoros együttműködési képesség mérnöki csapatokkal a megbízhatóság javítása érdekében

Előny

  • Kubernetes és cloud-native platformok
  • GitOps tapasztalat (Flux vagy Argo CD)
  • Jenkins és Ansible ismeret
  • Service Mesh, Ingress és API Gateway tapasztalat
  • Magas rendelkezésre állású architektúrák
  • Több-régiós környezetek
  • Katasztrófa-helyreállítási megoldások
  • Titokkezelés (Vault, AWS Secrets Manager, External Secrets)
  • Biztonság, megfelelőség és sebezhetőség-kezelés
  • Ügyeleti (on-call) működés és runbook tervezés

Soft skillek

Hibaelhárítás élő rendszerekenSzoros együttműködés mérnöki csapatokkalProaktív kockázatazonosítás és -kezelés

Amit kínálunk

  • Kimagasló teljesítménykultúra: 99%-os projektsikerrel és 30%+ éves bevételnövekedéssel rendelkező technológiai csapat
  • Versenyképes fizetés

Hasonló állások