Állás

Site reliability engineer – IDP

DevOps / SRE • Remote • Teljes munkaidő • Portugália Portugália

Az Intermedia SRE-csapatába keresnek mérnököt, aki a legfontosabb alkalmazások és szolgáltatások megbízhatóságáért, rendelkezésre állásáért és teljesítményéért felel. A munka főként távoli, alkalmanként a coimbrai irodában végzett jelenléttel.

Feladatok

  • ▹Kritikus alkalmazások és szolgáltatások rendelkezésre állásának, teljesítményének és megbízhatóságának biztosítása monitorozási, riasztási és optimalizálási stratégiákkal
  • ▹SLI-k, SLO-k és hibakeretek (error budget) meghatározása, mérése és fenntartása
  • ▹Együttműködés a fejlesztőcsapatokkal a teljesítmény javítása, a késleltetés csökkentése és az alkalmazások ellenálló képességének növelése érdekében
  • ▹Együttműködés a platform- és DevOps-csapatokkal az infrastruktúra és az alkalmazás-megbízhatóság összehangolásán
  • ▹Megbízhatósági szabványok és üzemeltetési védőkorlátok meghatározása a platformképességekhez és a golden path-okhoz
  • ▹Rugalmas önkiszolgáló képességek tervezése a platformmérnöki csapatokkal
  • ▹Üzemeltetési feladatok automatizálása: telepítések, visszaállítások, skálázás, feladatátvétel és helyreállítás
  • ▹CI/CD-pipeline-ok folyamatos fejlesztése a kézi beavatkozás csökkentésére és a biztonságos, fokozatos szállítás támogatására
  • ▹Automatizált validálás, megbízhatósági ellenőrzések és üzemeltetési védőkorlátok beépítése a fejlesztési és telepítési folyamatokba
  • ▹Megfigyelhetőség kialakítása és fenntartása az éles rendszerekben (metrikák, naplók, trace-ek, dashboardok)
  • ▹Dashboardok, riasztások és üzemeltetési nézetek fejlesztése a rendszerállapot valós idejű követéséhez
  • ▹Kulcsszereplőként részvétel az incidensek kezelésében, hibaelhárításban és megoldásban
  • ▹Gyökérok-elemzés és hosszú távú korrekciós lépések az incidensek megismétlődése ellen
  • ▹Fire drill-ek, game day-ek és chaos engineering gyakorlatok futtatása a rendszer ellenálló képességének ellenőrzésére
  • ▹Erőforrás-használat, kapacitástrendek és skálázási viselkedés figyelése a jövőbeli növekedés támogatására
  • ▹Együttműködés a biztonsági csapatokkal a biztonsági gyakorlatok, hozzáférés-szabályozás és adatvédelem érvényesítésében
  • ▹Éles üzemkészültségi és üzemeltetési értekezletek vezetése vagy az azokban való részvétel
  • ▹A megbízhatósági mérnöki gyakorlatok terjesztése és a szervezet üzemeltetési érettségének erősítése

Elvárások

  • ▹Informatikai, mérnöki vagy kapcsolódó területen szerzett alapképzés, vagy ezzel egyenértékű gyakorlati tapasztalat
  • ▹Bizonyított tapasztalat SRE-, platformmérnöki vagy infrastruktúra/DevOps-szerepkörben, erős üzemeltetési felelősséggel
  • ▹Erős szakértelem az alkalmazásmonitorozásban, megfigyelhetőségi platformokban, incidenskezelésben és éles hibaelhárításban
  • ▹Megbízhatósági mérnöki fogalmak (SLI, SLO, error budget, riasztási minőség, incidenskezelés) jó ismerete
  • ▹Szkriptelési és automatizálási tudás olyan eszközökkel és nyelvekkel, mint a Python, Bash, Terraform vagy Ansible
  • ▹Tapasztalat felhőplatformokkal: AWS, Azure vagy Google Cloud
  • ▹CI/CD-pipeline-ok, telepítés-automatizálás és fokozatos szállítási gyakorlatok jó ismerete
  • ▹Infrastructure as code és konfigurációkezelési megközelítések jó ismerete
  • ▹Tapasztalat konténerizációban és orkesztrációban, például Docker és Kubernetes
  • ▹Erős problémamegoldó készség, üzemeltetési ítélőképesség és figyelem a részletekre
  • ▹Kiváló kommunikációs és együttműködési készség mérnöki, platform- és biztonsági csapatok között

Előny

  • ▹Chaos engineering gyakorlatok és eszközök ismerete
  • ▹Tapasztalat belső platformok vagy platformmérnöki csapatok támogatásában
  • ▹Fejlesztői portálok, golden path-ok, szolgáltatáskatalógusok vagy önkiszolgáló platformminták ismerete
  • ▹A belső platformok fejlesztői élménymetrikáinak és üzemeltetési érettségének ismerete
  • ▹Mikroszolgáltatás-architektúrák és többbérlős környezetek ismerete
  • ▹Modern megfigyelhetőségi stackek és telemetriai szabványok ismerete
  • ▹UCaaS és CCaaS platformok, főként a hang- és kommunikációs szolgáltatási folyamatok ismerete
  • ▹Tapasztalat megbízhatósági kezdeményezések, incidens-visszatekintések vagy éles fejlesztési programok vezetésében
  • ▹Kapacitástervezés, ellenállóképesség-tesztelés és üzemkészültségi gyakorlatok ismerete

Soft skillek

Erős problémamegoldó készségKiváló kommunikáció és együttműködésAnalitikus gondolkodásKezdeményezőkészség, gyakorlatias szemlélet

Amit kínálunk

  • ▹Főként távoli munka, alkalmi coimbrai irodai jelenléttel
  • ▹A későbbiekben tervezett aveiroi és portói irodák

A munkáltatóról

Az Intermedia felhőalapú kommunikációs és együttműködési megoldásokat nyújtó vállalat, amely növekedésről, nyereségességről és a belső előléptetések kultúrájáról ismert. Sok munkatársa 10–20 éve dolgozik náluk.

Végzettség: Informatikai, mérnöki vagy kapcsolódó területen szerzett alapképzés, vagy ezzel egyenértékű gyakorlati tapasztalat

Hasonló állások