
Állás
· Senior
Senior Site Reliability Engineer
DevOps / SRE
• Senior
• Remote
• Teljes munkaidő
•
USA
A Replit Site Reliability Engineering csapatában biztosítod a világszerte milliókat kiszolgáló infrastruktúra megbízhatóságát, skálázhatóságát és teljesítményét, automatizálással és bevált gyakorlatokkal hidalva át a fejlesztés és üzemeltetés közti szakadékot.
Feladatok
- ▹Átfogó monitorozási és riasztási rendszerek tervezése és fejlesztése modern observability-eszközökkel
- ▹Dashboardok és metrikák létrehozása valós idejű rendszerállapot-láthatósághoz
- ▹Naplózási stratégiák megvalósítása a gyors problémaazonosításhoz
- ▹Infrastruktúra-automatizálás építése Terraform, Ansible vagy Pulumi eszközökkel
- ▹CI/CD pipeline-ok tervezése és karbantartása a megbízható, konzisztens telepítésekhez
- ▹Önjavító rendszerek létrehozása gyakori hibaforgatókönyvekhez
- ▹SLO-k és SLI-k meghatározása és nyomon követése a termék- és mérnöki csapatokkal együttműködve
- ▹Incidenskezelés vezetése, alapos post-mortemek és megelőző fejlesztések
- ▹Runbookok fejlesztése és karbantartása kritikus szolgáltatásokhoz
- ▹Az átlagos helyreállítási idő (MTTR) csökkentését szolgáló eszközök és folyamatok építése
- ▹Teljesítmény-optimalizálás: szűk keresztmetszetek azonosítása, kapacitástervezés, latenciacsökkentés globális régiókban
Elvárások
- ▹4-8 év tapasztalat Site Reliability Engineering vagy hasonló szerepkörben (DevOps, Systems Engineering, Infrastructure Engineering)
- ▹Erős programozási készségek automatizáláshoz használt nyelveken (Python, Go vagy hasonló)
- ▹Elosztott rendszerek mély ismerete
- ▹Tapasztalat konténer-orchestrációs platformokkal (Kubernetes) és felhő-natív technológiákkal
- ▹Bizonyított tapasztalat monitorozási/observability-megoldások bevezetésében és fenntartásában
- ▹Erős incidenskezelési készségek, incidensválasz-vezetési tapasztalattal
- ▹Tapasztalat infrastruktúra mint kód és konfigurációkezelő eszközökkel
Előny
- ▹Tapasztalat Google Cloud Platform (GCP) szolgáltatásokkal és eszközökkel
- ▹Modern observability-platformok ismerete (Prometheus, Grafana, Datadog stb.)
Soft skillek
Problémamegoldó szemlélet komplex üzemeltetési kihívásokhozÖnálló, autonóm munkavégzés kereszt-funkcionális együttműködés mellettErős kommunikációs készség technikai és nem technikai közönség feléFolyamatos tanulás és naprakészség az iparági bevált gyakorlatokkalAutomatizálásra való fókusz
Amit kínálunk
- ▹Versenyképes fizetés és részvényopció
- ▹401(k) nyugdíjprogram 4%-os céges hozzájárulással (csak USA)
- ▹Egészségügyi, fogászati, látás- és életbiztosítás
- ▹Rövid és hosszú távú rokkantsági biztosítás
- ▹Fizetett szülői, egészségügyi és gondozói szabadság
- ▹Rugalmas szabadságkeret (FTO) és munkaszüneti napok
- ▹Ingázási támogatás (irodai munkavégzés esetén)
- ▹Havi wellness-támogatás
- ▹Önálló munkavégzési környezet
- ▹Otthoni irodai felszerelés visszatérítése (irodai munkavégzés esetén)
- ▹Negyedéves csapattalálkozók
- ▹Irodai kényelmi szolgáltatások (irodai munkavégzés esetén)
A munkáltatóról
A Replit egy ágens-alapú szoftverfejlesztési platform, amely bárki számára lehetővé teszi alkalmazások építését természetes nyelven. Több millió fejlesztőt szolgál ki világszerte, demokratizálva a szoftverfejlesztést.
Hasonló állások

Állás
· Senior
Senior Site Reliability Engineer (FedRAMP)
Okta
AI/MLArgocdDatadog
+14
165 000–227 000 USD/év
bruttó
🏢 Helyszíni
San Francisco
🗣️ EN

Állás
· Senior
Azure Cloud DevOps Engineer
Leidos
Azure Devops
+18
87 100–157 450 USD/év
bruttó
🌍 Remote
🗣️ EN

Állás
· Senior
Engineer II, Site Reliability (Remote, GBR)
CrowdStrike
Cpp
+5
💰 Bér: nincs megadva
🌍 Remote
🗣️ EN

Állás
· Senior
Senior Site Reliability Engineer - Undersea Dominance
Anduril
AI/MLArtifactory
+21
166 000–250 000 USD/év
bruttó
🏢 Helyszíni
Costa Mesa
🗣️ EN

Állás
· Senior
Senior Site Reliability Engineer
Lambda
AI/MLClickhouse
+7
240 000–356 000 USD/év
bruttó
🌍 Remote
San Francisco Office (Fremont St)
🗣️ EN

Állás
· Senior
Senior DevOps Developer
Autodesk
DatadogDynamodb
+9
107 000–157 300 USD/év
bruttó
🌍 Remote
🗣️ EN