Remote AI Adversarial Red Teamer: Jailbreak & Prompt Injection

AI Trainer Jobs

United States

Remote

USD 96,000 - 138,000

Part time

3 days ago
Be an early applicant
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

AI Trainer Jobs is seeking a remote contractor to perform adversarial red-teaming on AI systems. You will craft jailbreak prompts, document failures with exact reproduction steps, and assess defenses across single and multi-turn conversations.

Responsibilities include triaging new attack vectors, assigning severity, and contributing to patch tickets with clear, policy-grounded rationales. Remote work eligible from the US; hourly compensation is discussed after interview.

Qualifications

  • Proven experience red-teaming AI systems or adversarial ML work.
  • Ability to document failures with rigorous steps for reproduction.
  • Familiarity with jailbreak, prompt-injection and policy taxonomy.
  • Ability to work asynchronously for 10+ hours per week.
  • Strong written communication to convert findings into patch tickets.

Responsibilities

  • Design adversarial prompts that probe known weakness classes.
  • Document every successful attack with reproduction steps and policy violations.
  • Score model defenses across single-turn and multi-turn conversations.
  • Triage emerging attack vectors and route them to the safety team.

Skills

Adversarial prompting
Red-team analysis
Policy taxonomy
Failure documentation
Jailbreak exploitation
Security review
Adversarial testing
Threat modeling
Jailbreak
Exploit

Job description

AI Trainer Jobs is seeking a remote contractor to perform adversarial red-teaming on AI systems. You will craft jailbreak prompts, document failures with exact reproduction steps, and assess defenses across single and multi-turn conversations.

Responsibilities include triaging new attack vectors, assigning severity, and contributing to patch tickets with clear, policy-grounded rationales. Remote work eligible from the US; hourly compensation is discussed after interview.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Remote AI Adversarial Red Teamer — Jailbreak & Prompt Testing
Remote AI Adversarial Red Teamer — Jailbreak & Prompt Testing

AI Trainer Jobs • United States

Remote
USD 96,000 - 138,000
Remote AI Adversarial Testing Red Team Engineer
Remote AI Adversarial Testing Red Team Engineer

AI Trainer Jobs • United States

Remote
USD 96,000 - 138,000
AI Jailbreak & Prompt-Injection Security Specialist Remote
AI Jailbreak & Prompt-Injection Security Specialist Remote

AI Trainer Jobs • United States

Remote
USD 96,000 - 138,000
Remote Adversarial AI Security Engineer (AppSec)
Remote Adversarial AI Security Engineer (AppSec)

AI Trainer Jobs • United States

Remote
USD 96,000 - 138,000
Remote AI Safety Red Team Specialist (Adversarial Testing)
Remote AI Safety Red Team Specialist (Adversarial Testing)

AI Trainer Jobs • United States

Remote
USD 90,000 - 96,000
Remote AI Adversarial Security Engineer | Jailbreak Testing
Remote AI Adversarial Security Engineer | Jailbreak Testing

AuraOne, Inc. • United States

On-site
USD 55,000 - 110,000
Remote — US-eligible
Contractor engagement
AI Red Team Specialist — Adversarial Testing (Remote)
AI Red Team Specialist — Adversarial Testing (Remote)

Mercor • San Francisco (CA)

Remote
USD 130,000 - 170,000
Remote AI Red Team Specialist: Adversarial Prompt Testing
Remote AI Red Team Specialist: Adversarial Prompt Testing

AI Trainer Jobs • United States

Remote
USD 90,000 - 96,000
Remote AI Adversarial Red Teamer – Supply Chain Security
Remote AI Adversarial Red Teamer – Supply Chain Security

AI Trainer Jobs • United States

Remote
USD 96,000 - 138,000
Remote LLM Red Team: Failure Modes & Edge Cases
Remote LLM Red Team: Failure Modes & Edge Cases

AI Trainer Jobs • United States

Remote
USD 83,000 - 124,000