Állás · Senior

Senior Site Reliability Engineer

DevOps / SRE • Senior • Remote • Teljes munkaidő Európai Unió EU/EMEA

Az Alpaca, egy globális agent-first brókeri infrastruktúra cég, Senior Site Reliability Engineert keres, aki a brókeri platform megbízhatóságáért, megfigyelhetőségéért és üzemeltethetőségéért felel a felhő infrastruktúrán, a Kubernetes platformon és az adatrétegen keresztül.

Feladatok

  • Napi szintű termelési üzemeltetés: ügyelet, incidenskezelés, postmortemek és a lezáró követő lépések
  • A megbízhatósági gyakorlat tulajdonlása: SLI/SLO-k és hibaköltségvetések meghatározása és finomítása
  • A megfigyelhetőség erősítése metrikák, logok, nyomkövetés és riasztás terén
  • Infrastruktúra szállítása kódként GitOps munkafolyamatban, felhő erőforrások és Kubernetes workloadok esetén egyaránt
  • PostgreSQL gondozása: teljesítményhangolás, séma- és migrációfelülvizsgálat, online migrációk nagy táblákon, HA/DR, CDC pipeline-ok
  • Mérnökök mentorálása megbízhatósági és adatbázis alapokban code review, design review és páros munka révén

Elvárások

  • 4+ év tapasztalat SRE, DevOps, Platform/Infrastruktúra vagy backend fejlesztői szerepben, jelentős termelési üzemeltetési felelősséggel
  • Gyakorlati tapasztalat termelési szolgáltatások Kubernetesen történő üzemeltetésében, infrastruktúra kódként történő szállításában GitOps munkafolyamatban
  • Szilárd PostgreSQL termelési ismeretek: lekérdezési tervek, pg_stat_*, indexelés és séma-kompromisszumok, biztonságos online migráció nagy táblán
  • Felhő hálózati alapok (VPC-k, útválasztás, L4/L7 terheléselosztás, DNS, TLS) és a szolgáltatások közötti kapcsolódási hibák elhárítása

Soft skillek

Ügyeleti felelősségvállalásMentorálásKereszfunkcionális együttműködés

A munkáltatóról

Az Alpaca egy USA-székhelyű, globális agent-first brókeri infrastruktúra cég részvényekhez, ETF-ekhez, opciókhoz, kriptóhoz, fix kamatozású eszközökhöz és 24/5 kereskedéshez, több mint 10 millió brókeri számlával 40 országban.

Hasonló állások