
Állás
· Principal
LLM Serving mérnök (Cloud AI Engineering), Senior / Staff
AI / ML Engineer
• Principal
• Helyszíni
• Teljes munkaidő
•
San Diego, USA
A Qualcomm Cloud AI csapata hardver- és szoftvermegoldásokat fejleszt inferenciagyorsításhoz. Az LLM Serving mérnök egy skálázható LLM inferencia platform építésében vesz részt, a kutatás-fejlesztéstől a kereskedelmi bevezetésig.
Feladatok
- ▹Skálázható LLM inferencia platform építése (disaggregated serving, KV-cache kezelés, fejlett párhuzamosítás, spekulatív algoritmusok, modelloptimalizálás, dedikált kernelek).
- ▹Közreműködés LLM serving csomagok fejlesztésében (vLLM, SGLang, TGI, Triton Inference Server, Dynamo, LLM-d).
- ▹Szoros együttműködés az ügyfelekkel, valamint a belső compiler-, firmware- és platformcsapatokkal.
- ▹Fejlett algoritmusok (attention mechanizmusok, MoE-k) és numerikus módszerek megértése új optimalizálási lehetőségek azonosításához.
- ▹Hatékony serving biztosítása intelligens autoscaling, terheléselosztás és routing révén.
- ▹Aktív részvétel a nyílt forráskódú serving közösségekben.
Elvárások
- ▹Számítástechnika, informatika, mérnöki vagy villamosmérnöki alapszak és 4+ év tapasztalat (vagy mesterdiploma és 3+ év, vagy PhD és 2+ év).
- ▹MSc számítástechnika, gépi tanulás, számítástechnika-mérnöki vagy villamosmérnöki területen.
Előny
- ▹Gyakorlati tapasztalat LLM serving/orchestration csomagokkal (Triton Inference Server, vLLM, SGLang, Ollama, llm-d, KServe, LMCache, MoonCake).
- ▹Alapos ismeretek nagy nyelvi modellekről, VLM-ekről, SLM-ekről, transformer-architektúrákról.
- ▹Erős tapasztalat nyelvi modellek fejlesztésében PyTorch-csal.
- ▹Erős informatikai alapok: algoritmusok, adatstruktúrák, párhuzamos és elosztott programozás.
- ▹Számítógép-architektúra, ML-gyorsítók, in-memory feldolgozás és elosztott rendszerek ismerete.
- ▹Erős Python fejlesztői készségek nagyléptékű projektekhez.
- ▹Mélytanuló workload-ok elemzésének, profilozásának és optimalizálásának tapasztalata.
- ▹Nyílt forráskódú hozzájárulás bármely GenAI csomaghoz.
- ▹Nagyméretű elosztott rendszerek architektúrájának és fejlesztésének tapasztalata.
- ▹Magas szintű kernel-tervezési tapasztalat (PyTorch, CUDA, Triton).
- ▹torch.compile vagy torchDynamo ismerete.
- ▹PhD számítástechnika, számítástechnika-mérnöki vagy gépi tanulás területen.
Soft skillek
Kiváló kommunikációs és problémamegoldó készségek.Gyors tempójú, együttműködő környezetben való helytállás.Proaktív tanulás a legújabb inferencia-optimalizálási technikákról.
Amit kínálunk
- ▹Éves diszkrecionális bónuszprogram.
- ▹Éves RSU-juttatás (részvényjuttatás).
- ▹Versenyképes juttatási csomag.
A munkáltatóról
A Qualcomm hagyományos vezeték nélküli technológiai erősségeit a Cloud AI fejlődésének középpontjába állítja, hardver- és szoftvermegoldásokat fejlesztve az inferenciagyorsításhoz.
Végzettség: Számítástechnika, informatika, mérnöki vagy villamosmérnöki alapszak (MSc előny).
Hasonló állások

Állás
· Principal
Principal Applied Scientist- AI
UiPath
AI/MLHuggingfaceLlm
+2
218 000–265 000 USD/év
bruttó
🏢 Helyszíni
Bellevue
🗣️ EN

Állás
· Principal
Principal Engineer, AI/ML Architecture - 11310
Coupa
AI/MLLlm
241 000–337 400 USD/év
bruttó
🏢 Helyszíni
Foster City
🗣️ EN

Állás
· Principal
Principal AI/ML Engineer
Pragmatike
AI/MLData Science
+5
💰 Bér: nincs megadva
🔀 Hibrid
San Francisco
🗣️ EN

Állás
· Principal
Staff Machine Learning Engineer, Applied Research
Pinterest
AI/MLCppLlmMlflow
+3
189 308–389 753 USD/év
bruttó
🔀 Hibrid
San Francisco
🗣️ EN

Állás
· Principal
Staff Machine Learning Engineer, Personalization
Spotify
AI/MLBigqueryLlm
+1
💰 Bér: nincs megadva
🏢 Helyszíni
New York
🗣️ EN

Állás
· Principal
AI teljesítménymérnök (Cloud AI Engineering), Sr | Staff | Sr. Staff
Qualcomm
AI/MLLlm
178 400–267 600 USD/év
bruttó
🏢 Helyszíni
San Diego
🗣️ EN