Jobs · Research

AI Safety Expert - Red Teamer

Mercor · United States · 2 days ago
RemoteRemoteResearch$17–$25/hrPart-time

Role Responsibilities

  • Red team conversational AI models and agents by conducting jailbreaks, prompt injections, and bias exploitation.
  • Generate high-quality human data by annotating failures, classifying vulnerabilities, and flagging systemic risks.
  • Apply structure using taxonomies, benchmarks, and playbooks to ensure consistent testing.
  • Document reproducibly by producing reports, datasets, and attack cases for customer action.
  • Review AI outputs on sensitive topics like bias and misinformation, with optional participation in higher-sensitivity projects.

Qualifications

  • Must-have: Fluent in English and Vietnamese.
  • Prior experience in red teaming, AI adversarial work, or cybersecurity.
  • Ability to explain risks clearly to both technical and non-technical stakeholders.

Preferred Experience

  • With adversarial ML, cybersecurity, and socio-technical risk.
  • Skills in creative probing, psychology, acting, or writing for unconventional adversarial thinking.

Similar jobs