Mercor seeks experienced AI Safety Red Teamers to identify vulnerabilities in frontier AI systems through adversarial testing. You will design challenging prompts, uncover model weaknesses, and evaluate AI behavior across complex, high-risk topics.
Responsibilities include crafting adversarial prompts, detecting jailbreaks and policy failures, and documenting vulnerabilities to support safety benchmarking and red-teaming reports.
📌 Adversarial AI Safety Architect for Frontier Models (Roma)
🏢 Mercor
📍 Roma
Candidati a questo annuncio
Mostra le tue capacità professionali all'azienda, compila il form e lascia un tocco personale nella lettera di presentazione, aiuterà il recruiter nella scelta del candidato.