Állás

Site Reliability Engineer

DevOps / SRE • Remote • Teljes munkaidő Szingapúr Szingapúr

A Supabase önálló SRE gyakorlatot épít a Service Operations csapaton belül, és olyan mérnököt keres, aki nem a más csapatok infrastruktúráját tulajdonolja, hanem azokat a gyakorlatokat és visszacsatolási hurkokat alakítja ki, amelyekkel a csapatok saját maguk gazdálkodnak a megbízhatósággal.

Feladatok

  • SLI-k és SLO-k definiálása a szolgáltató csapatokkal közösen, ügyfélélményre alapozva, majd error budget házirendek kialakítása
  • Az Operational Readiness Review (ORR) folyamat tulajdonlása és fejlesztése új szolgáltatásokhoz és nagyobb változtatásokhoz
  • Az incidens-tanulság folyamat erősítése: postmortem eredmények összekötése az üzemkészségi hiányosságokkal, ismétlődő hibaminták azonosítása
  • Megbízhatósági szakértőként való közreműködés architektúra-felülvizsgálatokban, hibamód-elemzésben, függőségtérképezésben
  • Az operatív terhek (toil) azonosítása és mennyiségi meghatározása, automatizálás építése vagy szorgalmazása
  • Fenntartható ügyeleti gyakorlatok kialakításának segítése: riasztásminőség, eszkalációs útvonalak, runbook-lefedettség
  • A szervezet-szintű operatív érettség nyomon követése és jelentése, rendszerszintű hiányosságok feltárása

Elvárások

  • 7+ év tapasztalat SRE, production engineering vagy megbízhatóság-fókuszú szerepkörben, beleértve SRE gyakorlatok kialakítását és elterjesztését csapatok között
  • Szoftvermérnöki szemlélet: kódot ír és eszközöket épít, nem csak konfigurál
  • Gyakorlati tapasztalat SLO-k/SLI-k skálázott definiálásában és operacionalizálásában, olyan error budget házirendekkel, amelyek ténylegesen befolyásolták a mérnöki döntéseket
  • Mély tapasztalat incidenskezelésben, postmortem facilitálásban, a tanulságok rendszerszintű fejlesztésekké alakításában
  • Nagy méretű, multi-tenant rendszerekkel szerzett tapasztalat (előny: menedzselt adatbázis-platform vagy Postgres)
  • Jártasság felhő infrastruktúrában (preferáltan AWS) és infrastructure-as-code eszközökben (preferáltan Pulumi, elfogadható Terraform/CDK is)
  • Világos és meggyőző kommunikáció, tekintélyen túli befolyásolási képesség elosztott szervezetben
  • Tapasztalat aszinkron vagy globálisan elosztott csapatokban

Előny

  • Kubernetes-alapú platform-üzemeltetési tapasztalat
  • Ismeretség OpenTelemetry, VictoriaMetrics, Grafana vagy hasonló megfigyelhetőségi eszközökkel
  • Fejlesztőknek szóló megbízhatósági eszközök építése (SLO dashboardok, ORR keretrendszerek, toil-követés, DORA metrikák)

Soft skillek

Befolyásolás tekintély nélkül, elosztott szervezetbenMotiváció mások hatékonyabbá tételéből, nem a saját technikai hősiességbőlAszinkron, globálisan elosztott csapatban való hatékony munkavégzés

Amit kínálunk

  • Teljesen távoli munkavégzés, WeWork tagság vagy közösségi iroda támogatás bárhol a világon
  • ESOP (tulajdonrész) minden munkatársnak
  • Technikai keret az ideális munkakörnyezet kialakítására (laptop, monitor, headset, stb.)
  • Egészségügyi juttatás: a cég 100%-ban fedezi a munkavállaló, 80%-ban a hozzátartozók biztosítását
  • Éves céges összejövetel egy-egy új városban
  • Rugalmas, aszinkron munkavégzés
  • Éves továbbképzési keret

A munkáltatóról

A Supabase a Postgres fejlesztői platform, fejlesztők által fejlesztőknek építve — Database, Auth, Storage, Edge Functions, Realtime és Vector Search. Több millió Postgres-példányt kezelnek. A csapat born-remote és open-source-first szemléletű: 280+ munkatárs, 55+ ország, 500 000+ közösségi tag, 500M dollár tőkebevonás.

Hasonló állások