Állás

AI platform vezető (vállalati AI platformok)

Egyéb • Helyszíni • Teljes munkaidő Amerikai Egyesült Államok San Diego, USA

A Qualcomm tapasztalt AI platform vezetőt keres, aki a teljes AI platform stratégiájáért, architektúrájáért és üzemeltetéséért felel, a helyben üzemeltetett GPU-klaszterektől a felhőig (AWS/GCP/Azure). A szerep egy kb. 10 fős globális mérnökcsapatot vezet, amely megbízható, biztonságos és költséghatékony infrastruktúrát biztosít tanításhoz, finomhangoláshoz, inferenciához, kereséshez és ágens-alapú orkesztrációhoz. Teljes munkaidős, helyszíni pozíció San Diegóban (heti 5 nap).

Feladatok

  • Az AI platform stratégiájának és többéves ütemtervének kialakítása egy többbérlős, hibrid (helyi + felhő) platformhoz
  • Platform SLA-k/SLO-k, megbízhatósági célok és biztonsági/megfelelőségi korlátok meghatározása
  • Helyben üzemeltetett GPU-klaszterek üzemeltetése és optimalizálása (Kubernetes + GPU operátor és/vagy Slurm), kapacitástervezés, ütemezés
  • MLOps/LLMOps szolgáltatás nyújtása: adat-előkészítés, tanítás/finomhangolás, modellregiszter, kormányzás, kiértékelés, biztonságos üzembe helyezés
  • CI/CD kialakítása modellekhez, promptokhoz és ágensekhez, automatizált kiértékeléssel és canary/A-B kiadásokkal
  • Ágens-alapú AI orkesztráció (A2A minták) és MCP-szerverek integrációjának vezetése
  • Felhő alapú AI/ML platformok (AWS/Azure/GCP) kihasználása tanításhoz és inferenciához
  • Alap platform-szolgáltatások (identitás/RBAC, titkok kezelése, megfigyelhetőség, vektor-adatbázisok, modell-átjárók) tulajdonlása
  • Kb. 10 fős globális platform/SRE/MLOps csapat vezetése, 24/7 ügyeleti renddel, incidenskezeléssel
  • Stratégiai beszállítói kapcsolatok és licencelés kezelése

Elvárások

  • 15+ év mérnöki/technológiai tapasztalat, ebből kb. 10 év nagy méretű platformok (AI/ML, adat vagy HPC) építésében és üzemeltetésében
  • 5+ év csapatvezetői tapasztalat kb. 10 fős platform/SRE/MLOps/LLMOps csapat élén
  • Gyakorlati tapasztalat helyben üzemeltetett GPU-klaszterek üzemeltetésében (Kubernetes+GPU operátor és/vagy Slurm)
  • Erős MLOps/LLMOps tapasztalat a modell-életciklus egészén (adat → tanítás → regiszter → üzembe helyezés)
  • Mély AWS/GCP/Azure ismeret, menedzselt Kubernetesszel (EKS/AKS/GKE)
  • DevOps/platformmérnöki gyakorlat: CI/CD, GitOps, Terraform/Bicep/Helm, Docker, Kubernetes
  • Ágens-orkesztráció, A2A-minták és MCP-szerverek éles üzemeltetésének ismerete
  • Alapdiploma mérnöki, informatikai vagy rokon területen

Előny

  • Mesterdiploma vagy PhD informatika/villamosmérnöki/matematika területen
  • Tapasztalat PyTorch, CUDA/cuDNN, Triton Inference Server, vLLM, KServe, Ray, Slurm eszközökkel
  • Nagy áteresztőképességű tárolók (Lustre, BeeGFS, Ceph) és vektor-adatbázisok (FAISS, Milvus, Pinecone) ismerete
  • MLOps eszközlánc: MLflow, Airflow/Argo, Weights & Biases, LangSmith
  • Biztonság/kormányzás: OIDC/RBAC, OPA policy-as-code, AWS Secrets Manager/Azure Key Vault
  • Ágens-keretrendszerek: Semantic Kernel, LangChain, CrewAI, AutoGen

Soft skillek

Erős kommunikáció vezetőkkel és technikai vezetőkkel, világos metrikák és üzleti értékbemutatásGlobális, időzóna-független csapatvezetésCoaching, toborzás és teljesítményértékelés

Amit kínálunk

  • Versenyképes éves diszkrecionális bónuszprogram
  • Éves RSU-juttatás lehetősége
  • Kiemelkedően versenyképes béren kívüli juttatási csomag

A munkáltatóról

A Qualcomm Incorporated globális technológiai vállalat. A pozíció az Engineering Group – Software Engineering szervezetébe tartozik, és a teljes vállalati AI platform infrastruktúráját építi és üzemelteti.

Végzettség: Alapdiploma mérnöki, informatikai vagy rokon területen (mester/PhD előny)

Hasonló állások