Állás · Mid-level

AI biztonsági szakértő – teljesen távoli

Egyéb • Mid-level • Remote • Teljes munkaidő • Ausztria Ausztria

Szerződéses AI red teaming szerep, amelyben adverzális promptok tervezésével kell feltárni a frontier AI modellek biztonsági gyengeségeit, és hozzájárulni a biztonsági benchmarkokhoz.

Feladatok

  • ▹Adverzális promptok tervezése a frontier AI modellek terhelés alatti tesztelésére
  • ▹Jailbreakek, nem biztonságos viselkedések, hallucinációk és irányelv-sértések azonosítása
  • ▹A modellek robusztusságának értékelése a dezinformáció, kiberbiztonság, biológiai biztonság, csalás, politikai tartalom és más érzékeny területeken
  • ▹Sebezhetőségek dokumentálása, közreműködés biztonsági benchmarking és red-teaming jelentésekben
  • ▹Együttműködés AI-kutatókkal a modell-illesztés (alignment), robusztusság és biztonság javítása érdekében

Elvárások

  • ▹5+ év professzionális tapasztalat AI biztonság, AI red teaming, trust & safety, kiberbiztonság, oknyomozó újságírás, élettudományok vagy kapcsolódó terület valamelyikén
  • ▹Erős analitikus gondolkodás, prompttervezési és írásbeli kommunikációs készségek
  • ▹Tapasztalat adverzális promptok tervezésében vagy frontier AI rendszerek kiértékelésében

Előny

  • ▹Tapasztalat AI red teaming, RLHF, SFT vagy AI alignment területén
  • ▹Jailbreak-tesztelés, prompt engineering vagy adverzális kiértékelési módszertanok ismerete
  • ▹Szakértelem valamely szürke zónás területen: kiberbiztonság, biológiai biztonság, politikai tartalom, dezinformáció vagy tudományos biztonság

A munkáltatóról

A Mercor kiváló kreatív és technikai tehetségeket köt össze vezető AI-kutatólaborokkal. Székhelye San Franciscóban van, befektetői között olyan nevek szerepelnek, mint a Benchmark, a General Catalyst, Peter Thiel, Adam D'Angelo, Larry Summers és Jack Dorsey.

Végzettség: Alapképzés vagy magasabb végzettség számítástechnika, kiberbiztonság, újságírás, kommunikáció, pszichológia, biológia, kémia, közpolitika vagy kapcsolódó területen

Hasonló állások