Állás · Mid-level

AI-infrastruktúra és platformüzemeltetési mérnök (távmunka az EU-ból)

Egyéb • Mid-level • Remote • Teljes munkaidő • Lengyelország Lengyelország

A Mirantis európai AI-infrastruktúra- és platformüzemeltetési csapatot épít, amely NVIDIA GPU-kra, nagy teljesítményű hálózatra és Kubernetesre épülő, több adatközpontban futó AI-környezeteket üzemeltet. A szerepkör műszakos üzemeltetési környezetben zajlik.

Feladatok

  • ▹Éles AI-infrastruktúra-platformok monitorozása, üzemeltetése és támogatása
  • ▹Infrastruktúra-, hálózati, hardver- és platformincidensek kivizsgálása és megoldása
  • ▹NVIDIA GPU infrastruktúra és a kapcsolódó platformszolgáltatások támogatása
  • ▹Kubernetes-alapú környezetek monitorozása és hibaelhárítása
  • ▹Teljesítmény-, rendelkezésre állási és megbízhatósági problémák vizsgálata
  • ▹Együttműködés fejlesztőcsapatokkal, hardverszállítókkal, adatközponti munkatársakkal és szolgáltatásnyújtó csapatokkal
  • ▹Részvétel az incidenskezelésben, a kiváltó ok elemzésében és az üzemeltetési fejlesztésekben
  • ▹A monitorozás, megfigyelhetőség, automatizálás és üzemeltetési folyamatok fejlesztése
  • ▹Üzemeltetési dokumentáció, runbookok és tudásbázis-cikkek karbantartása

Elvárások

  • ▹Legalább 3 év tapasztalat infrastruktúra-, platform-, hálózat-, felhő- vagy adatközpont-üzemeltetésben, SRE-ben vagy rokon műszaki területen
  • ▹Erős Linux-adminisztrációs és hibaelhárítási készség
  • ▹Jó hálózati ismeretek, infrastruktúra-problémák diagnosztizálásában szerzett tapasztalat
  • ▹Kubernetes gyakorlati ismerete éles környezetben
  • ▹Éles infrastruktúra és szolgáltatások támogatásának tapasztalata
  • ▹Erős elemző- és problémamegoldó képesség
  • ▹Strukturált üzemeltetési és incidenskezelési folyamatokban szerzett tapasztalat
  • ▹Kiváló kommunikációs és együttműködési készség
  • ▹Műszakos üzemeltetési környezetben való munkavégzés képessége

Előny

  • ▹NVIDIA GPU infrastruktúra és gyorsított számítási platformok
  • ▹InfiniBand hálózat és NVIDIA UFM
  • ▹Kubernetes-platformok üzemeltetése
  • ▹AI-infrastruktúra vagy HPC környezetek
  • ▹Site Reliability Engineering (SRE) vagy platform engineering
  • ▹Megfigyelhetőségi platformok: Grafana, Prometheus, ELK vagy OpenTelemetry
  • ▹Infrastruktúra-automatizálás és Infrastructure-as-Code gyakorlatok
  • ▹Nagy léptékű elosztott rendszerek és éles platformok

Soft skillek

Elemző gondolkodásProblémamegoldásKommunikációEgyüttműködés

Amit kínálunk

  • ▹Munka a ma élesben futó legfejlettebb AI-infrastruktúra-környezetekkel
  • ▹Betekintés az NVIDIA GPU technológiákba, Kubernetes-platformokba és nagy teljesítményű hálózatokba
  • ▹Lehetőség az AI-infrastruktúra üzemeltetési módjának alakítására
  • ▹Növekvő szervezet, amely jelentősen fektet be az AI-infrastruktúrába

A munkáltatóról

A Mirantis Kubernetes-natív AI-infrastruktúra-cég, amely skálázható, biztonságos és szuverén infrastruktúrát biztosít AI- és gépi tanulási munkaterhelésekhez. Ügyfelei között olyan nagyvállalatok vannak, mint az Adobe, a DocuSign, a PayPal és a Volkswagen.

Hasonló állások