Állás · Senior

Senior HPC AI klaszter mérnök

Egyéb • Senior • Remote • Teljes munkaidő • Svájc Svájc

Az NVIDIA nagy teljesítményű HPC/AI klasztereket tervező és üzemeltető mérnököt keres a hálózati infrastruktúra csapatba, aki szuperszámítógépes és GPU-alapú rendszereken dolgozik. A szerepkör a tervezéstől a monitorozáson át a hibaelhárításig teljes életciklust lefed.

Feladatok

  • ▹Nagyméretű HPC/AI klaszterek tervezése, monitorozása
  • ▹Linux munkaütemezés és orchestráció kezelése
  • ▹CI/CD folyamatok fejlesztése, karbantartása
  • ▹Infrastruktúra-automatizálási eszközök fejlesztése
  • ▹Monitorozás szerverekhez, hálózathoz, tárolóhoz
  • ▹Hibaelhárítás hardvertől az alkalmazási rétegig
  • ▹Módszertanok dokumentálása belső csapatoknak

Elvárások

  • ▹Informatikai/mérnöki diploma, 8+ év tapasztalat
  • ▹HPC és AI technológiák (CPU, GPU, gyorskapcsolatok) ismerete
  • ▹Slurm, Kubernetes ütemező/orchestráció tapasztalat
  • ▹Linux (RedHat/CentOS, Ubuntu) és hálózat mély ismerete
  • ▹Tárolási megoldások: Lustre, GPFS, Weka.io
  • ▹Python és bash scriptelés
  • ▹Jenkins, Ansible, Puppet/Chef automatizálás
  • ▹InfiniBand, Ethernet protokollok
  • ▹Virtualizáció: VMware, Hyper-V, KVM, Citrix
  • ▹Felhőplatformok: AWS, Azure, GCP

Előny

  • ▹CPU/GPU architektúra ismerete
  • ▹Kubernetes és mikroszolgáltatás technológiák
  • ▹GPU hardver/szoftver (DGX, CUDA)
  • ▹RDMA (InfiniBand, RoCE) tapasztalat

Soft skillek

Együttműködés kutatókkal, fejlesztőkkel, ügyfelekkelDokumentálási és tudásmegosztási készség

A munkáltatóról

Az NVIDIA a hálózati klaszter-infrastruktúra csapatában szuperszámítógépeket és AI klasztereket épít úttörő technológiákkal.

Hasonló állások