AI Red Team Specialist — Adversarial Testing (Remote)

Mercor

San Francisco (CA)

Remote

USD 130,000 - 170,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Mercor is seeking responders for a remote AI safety red team. You will challenge conversational AI models with jailbreaks, prompt injections, and bias exploitation, producing high-quality data and reproducible reports for customers.

Ideal candidates have red teaming experience in AI or cybersecurity, are curious and structured, and can communicate risks clearly to technical and non-technical stakeholders. Remote work is available for this role.

Qualifications

  • Prior red teaming experience in AI adversarial work, cybersecurity, or socio-technical probing.
  • Ability to push systems to breaking points in a controlled, ethical way.
  • Use of frameworks or benchmarks to keep testing consistent.

Responsibilities

  • Red team conversational AI models and agents: jailbreaks, prompt injections, misuse cases, bias exploitation, multi-turn manipulation.
  • Generate high-quality human data: annotate failures, classify vulnerabilities, and flag systemic risks.
  • Document reproducibly: produce reports, datasets, and attack cases customers can act on.

Skills

Red team experience
Adversarial AI testing
Frameworks/benchmarks
Structured communication
Adaptability

Job description

Mercor is seeking responders for a remote AI safety red team. You will challenge conversational AI models with jailbreaks, prompt injections, and bias exploitation, producing high-quality data and reproducible reports for customers.

Ideal candidates have red teaming experience in AI or cybersecurity, are curious and structured, and can communicate risks clearly to technical and non-technical stakeholders. Remote work is available for this role.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Remote Adversarial ML Specialist — AI Safety Red Team
Remote Adversarial ML Specialist — AI Safety Red Team

Obsidian • San Francisco (CA)

Remote
USD 120,000 - 180,000
Remote work
Remote AI Safety Red Team Expert
Remote AI Safety Red Team Expert

Mercor • New York (NY)

On-site
USD 120,000 - 180,000
Remote AI Safety Red Teamer: Adversarial Testing
Remote AI Safety Red Teamer: Adversarial Testing

United States Digital Space LLC • United States

Remote
USD 96,000 - 116,000
Remote AI Safety Red Team Specialist
Remote AI Safety Red Team Specialist

Mercor • New York (NY)

On-site
USD 120,000 - 160,000
Remote AI Safety Red Team Specialist
Remote AI Safety Red Team Specialist

Mercor • San Francisco (CA)

On-site
USD 120,000 - 180,000
AI Safety Red Team Engineer (Remote • EN/DA)
AI Safety Red Team Engineer (Remote • EN/DA)

Neon • United States

Remote
USD 120,000 - 180,000
Remote AI Safety Red Team Specialist
Remote AI Safety Red Team Specialist

Mercor • San Francisco (CA)

Remote
USD 120,000 - 180,000
Remote AI Red Team Safety Specialist: Adversarial Testing
Remote AI Red Team Safety Specialist: Adversarial Testing

Obsidian • San Francisco (CA)

Remote
USD 90,000 - 130,000
Remote AI Adversarial Red Team Specialist
Remote AI Adversarial Red Team Specialist

Mercor • New York (NY)

Remote
USD 90,000 - 140,000
Remote AI Safety Red Team Engineer
Remote AI Safety Red Team Engineer

Neon • United States

Remote
USD 120,000 - 190,000