Obsidian is seeking experienced AI Safety Red Teamers to identify vulnerabilities in frontier AI systems through adversarial testing. You will design challenging prompts, uncover model weaknesses, and assess behavior on high-risk topics.Responsibilities include designing adversarial prompts, detecting jailbreaks and policy failures, evaluating robustness across misinformation, cyber, biosecurity and political content, and documenting findings for safety benchmarking.
📌 Frontier AI Safety Red Team Specialist (Madrid)
🏢 Obsidian
📍 Madrid
Postulate a este anuncio
Muestra tus habilidades a la empresa, rellenar el formulario y deja un toque personal en la carta, ayudará el reclutador en la elección del candidato.