Remote AI Adversarial Red Teamer – Jailbreak Scenarios

AuraOne

United States

On-site

USD 55,104 - 165,312

Part time

14 days+
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Benefits offered by this job

Contractor engagement
Remote work eligible (US)

Job summary

AuraOne is seeking a remote contractor for the Jailbreak Exploit Abuse Scenario Red Teamer role to stress-test AI systems against adversarial prompts. You will design jailbreak prompts, document failures with exact steps, and score defenses across single- and multi-turn conversations.

The ideal candidate has demonstrated red-teaming or adversarial ML experience, strong written reports, and the ability to operate in policy-grey areas with clear justification for actions taken.

Qualifications

  • Demonstrated experience red-teaming AI systems, security research, or adversarial ML work.
  • Strong written communication — reports become patch tickets.
  • Comfort working in policy-grey areas with clear documentation of what was attempted and why.

Responsibilities

  • Design adversarial prompts that probe known weakness classes (jailbreak, policy bypass, prompt injection) for assignments.
  • Document every successful attack with reproduction steps and the policy clause it violated.
  • Score model defenses across single-turn and multi-turn conversations.
  • Triage emerging attack vectors and route them to the safety team with severity ratings.
  • Maintain a personal library of attack patterns and propose new red-team rubrics.
  • Calibrate against the broader red-team cohort to keep coverage and severity consistent.

Skills

Adversarial prompting
Red-team analysis
Policy taxonomy
Failure documentation
Jailbreak
Exploit
Security review
Adversarial testing
Threat modeling
Scenario evaluation

Job description

AuraOne is seeking a remote contractor for the Jailbreak Exploit Abuse Scenario Red Teamer role to stress-test AI systems against adversarial prompts. You will design jailbreak prompts, document failures with exact steps, and score defenses across single- and multi-turn conversations.

The ideal candidate has demonstrated red-teaming or adversarial ML experience, strong written reports, and the ability to operate in policy-grey areas with clear justification for actions taken.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Remote AI Adversarial Prompt Red Teamer
Remote AI Adversarial Prompt Red Teamer

AuraOne • United States

On-site
USD 82,656 - 165,312
Remote AI Adversarial Prompting Red Teamer
Remote AI Adversarial Prompting Red Teamer

AuraOne • United States

On-site
USD 96,432 - 179,088
Remote AI Policy Adversarial Red Team Specialist
Remote AI Policy Adversarial Red Team Specialist

AuraOne • United States

On-site
USD 82,656 - 165,312
Remote work
Contractor engagement
Remote Adversarial AI Risk Evaluator (Red‑Team)
Remote Adversarial AI Risk Evaluator (Red‑Team)

AuraOne • United States

On-site
USD 82,656 - 123,984
AI Adversarial Red Team Specialist — Manipulation Risk
AI Adversarial Red Team Specialist — Manipulation Risk

AuraOne • United States

On-site
USD 82,656 - 137,760
Remote AI Adversarial Red Team Engineer
Remote AI Adversarial Red Team Engineer

AuraOne • United States

On-site
USD 82,656 - 130,872
Remote work (US-eligible)
Contractor terms
Remote Dual-Use AI Red Team Specialist
Remote Dual-Use AI Red Team Specialist

AuraOne • United States

On-site
USD 82,656 - 179,088
Remote Adversarial AI Security Evaluator (Jailbreak Focus)
Remote Adversarial AI Security Evaluator (Jailbreak Focus)

AuraOne • United States

On-site
USD 55,104 - 96,432
AI Red Team Specialist — Adversarial Testing (Remote)
AI Red Team Specialist — Adversarial Testing (Remote)

Mercor • San Francisco (CA)

Remote
USD 130,000 - 170,000
Remote Adversarial Prompt Expert - Contractor
Remote Adversarial Prompt Expert - Contractor

AuraOne • United States

On-site
USD 82,656 - 137,760