Állás · Principal

Staff Site Reliability Engineer

DevOps / SRE • Principal • Remote • Teljes munkaidő Amerikai Egyesült Államok USA

Staff Site Reliability Engineerként proaktívan azonosítod és elemzed a megbízhatósági problémákat a Replit teljes technológiai stack-jén, majd olyan szoftvereket és rendszereket tervezel, amelyek lépésfüggvényszerű javulást hoznak — miközben mentorálod a tágabb mérnöki csapatot is.

Feladatok

  • Átfogó monitorozási, naplózási és trace-elési megoldások architektúrájának tervezése és vezető szerepű megvalósítása
  • Megbízhatósági sztenderdek meghatározása és érvényesítése: SLO-k és SLI-k kidolgozása a termék- és mérnöki csapatokkal
  • Vezető szerep az incidenskezelésben nagy hatású incidenseknél, alapos, hibáztatásmentes post-mortemek vezetése
  • Automatizálás és infrastruktúra mint kód építése/fejlesztése (Terraform, Pulumi), CI/CD pipeline-ok karbantartása
  • Kubernetes-alapú teljesítményoptimalizálás nagyméretű felhő-telepítéseken, Docker és GCP fókusszal
  • Elosztott rendszerek mélyreható debuggolása és megerősítése hosszú távú javításokkal
  • Staff-szintű tervezési review-k más csapatok funkcióihoz és rendszereihez, a megbízhatóság, skálázhatóság, biztonság és üzemeltethetőség szempontjából
  • Junior és principal szintű mérnökök oktatása és mentorálása, a megbízhatóság mint alapérték elterjesztése
  • Magas minőségű, jól tesztelt kód írása Python vagy Go nyelven belső eszközökhöz és harmadik féltől származó integrációkhoz

Elvárások

  • 8-10 év tapasztalat Site Reliability Engineering vagy hasonló szerepkörben
  • Erős programozási készségek Python vagy Go nyelven, jól tesztelt kóddal
  • Elosztott rendszerek mély ismerete, szolgáltatás-orientált architektúrák tervezésének, építésének és skálázásának tapasztalatával
  • Mély tapasztalat konténer-orchestrációs platformokkal, kifejezetten Kubernetes-szel, és felhő-natív technológiákkal
  • Bizonyított tapasztalat kifinomult monitorozási és observability-megoldások tervezésében, megvalósításában és fenntartásában
  • Erős incidenskezelési készségek komplex rendszerek incidensválaszában, kritikus gondolkodással nyomás alatt
  • Tapasztalat infrastruktúra mint kód (pl. Terraform, Pulumi) és konfigurációkezelő eszközökkel
  • Kiváló írásbeli és szóbeli kommunikáció, mentori tapasztalat junior-tól principal szintig

Előny

  • Mély tapasztalat Google Cloud Platform (GCP) szolgáltatásokkal
  • Szakértői szintű ismeretek modern observability-platformokon (Prometheus, Grafana, Datadog, OpenTelemetry)
  • Tapasztalat nagy áteresztőképességű, alacsony latenciájú rendszerek tervezésében
  • Jelentős tapasztalat Go és Terraform nyelven/eszközzel
  • Gyors növekedésű startup-környezetben szerzett tapasztalat
  • Céges blogbejegyzések és képzési anyagok írásának tapasztalata

Soft skillek

Staff-szintű vezetői jelenlét mentorálás és iránymutatás terénKiváló kommunikáció és nyitott, átlátható kulturális gyakorlatok iránti elköteleződésKritikus gondolkodás nyomás alattElhivatottság a szoftverfejlesztés hozzáférhetőbbé tétele iránt

Amit kínálunk

  • Versenyképes fizetés és részvényopció
  • 401(k) nyugdíjprogram 4%-os céges hozzájárulással (csak USA)
  • Egészségügyi, fogászati, látás- és életbiztosítás
  • Rövid és hosszú távú rokkantsági biztosítás
  • Fizetett szülői, egészségügyi és gondozói szabadság
  • Rugalmas szabadságkeret (FTO) és munkaszüneti napok
  • Ingázási támogatás (irodai munkavégzés esetén)
  • Havi wellness-támogatás
  • Önálló munkavégzési környezet
  • Otthoni irodai felszerelés visszatérítése (irodai munkavégzés esetén)
  • Negyedéves csapattalálkozók
  • Irodai kényelmi szolgáltatások (irodai munkavégzés esetén)

A munkáltatóról

A Replit egy ágens-alapú szoftverfejlesztési platform, amely bárki számára lehetővé teszi alkalmazások építését természetes nyelven. Több millió fejlesztőt szolgál ki világszerte, demokratizálva a szoftverfejlesztést.

Hasonló állások