Remote AI Adversarial Red Teamer — Jailbreak & Prompt Testing

AI Trainer Jobs

United States

Remote

USD 96,000 - 138,000

Full time

3 days ago
Be an early applicant
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

AuraOne is seeking a remote Malware Analysis Abuse Scenario Red Teamer to stress-test AI systems against adversarial prompts. You will design jailbreaks, document failure modes, and pair each exploit with the violated rubric clause to guide patching and regression testing.

As part of the role, you will evaluate defenses across single-turn and multi-turn interactions, triage new attack vectors, and report with rigorous reproduction steps to support model hardening before shipping to customers.

Qualifications

  • Demonstrated experience red-teaming AI systems or adversarial ML work.
  • Strong written communication; reports become the patch ticket.
  • Familiarity with prompt-injection, jailbreak, and policy-bypass taxonomies.

Responsibilities

  • Design adversarial prompts that probe known weakness classes (jailbreak, policy bypass, prompt injection) for Malware Analysis Abuse Scenario Red Teamer assignments.
  • Document every successful attack with reproduction steps and the policy clause it violated.
  • Score model defenses across single-turn and multi-turn conversations.
  • Triage emerging attack vectors and route them to the safety team with severity ratings.

Skills

Adversarial prompting
Red-team analysis
Policy taxonomy
Failure documentation
Malware analysis
Threat modeling
Adversarial testing
Security research

Job description

AuraOne is seeking a remote Malware Analysis Abuse Scenario Red Teamer to stress-test AI systems against adversarial prompts. You will design jailbreaks, document failure modes, and pair each exploit with the violated rubric clause to guide patching and regression testing.

As part of the role, you will evaluate defenses across single-turn and multi-turn interactions, triage new attack vectors, and report with rigorous reproduction steps to support model hardening before shipping to customers.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Remote AI Adversarial Testing Red Team Engineer
Remote AI Adversarial Testing Red Team Engineer

AI Trainer Jobs • United States

Remote
USD 96,000 - 138,000
Remote AI Adversarial Security Analyst (Red Team)
Remote AI Adversarial Security Analyst (Red Team)

AI Trainer Jobs • United States

Remote
USD 96,000 - 138,000
Remote AI Adversarial Red Teamer: Jailbreak & Prompt Injection
Remote AI Adversarial Red Teamer: Jailbreak & Prompt Injection

AI Trainer Jobs • United States

Remote
USD 96,000 - 138,000
Remote AI Adversarial Security Engineer | Jailbreak Testing
Remote AI Adversarial Security Engineer | Jailbreak Testing

AuraOne, Inc. • United States

On-site
USD 55,000 - 110,000
Remote — US-eligible
Contractor engagement
Remote AI Safety Red Team Specialist
Remote AI Safety Red Team Specialist

AI Trainer Jobs • United States

Remote
USD 90,000 - 96,000
Remote AI Safety Red Team Specialist
Remote AI Safety Red Team Specialist

AI Trainer Jobs • United States

Remote
USD 90,000 - 96,000
Remote AI Safety Red Team Specialist (English & Thai)
Remote AI Safety Red Team Specialist (English & Thai)

AI Trainer Jobs • United States

Remote
USD 33,000 - 48,000
Remote AI Safety Cybersecurity Red Team Engineer
Remote AI Safety Cybersecurity Red Team Engineer

AI Trainer Jobs • United States

Remote
USD 83,000 - 124,000
Remote AI Prompt Injection Security Tester
Remote AI Prompt Injection Security Tester

AI Trainer Jobs • United States

Remote
USD 96,000 - 138,000
AI Red Team Specialist — Adversarial Testing (Remote)
AI Red Team Specialist — Adversarial Testing (Remote)

Mercor • San Francisco (CA)

Remote
USD 130,000 - 170,000