Remote Adversarial AI Security Evaluator (Jailbreak Focus)

AuraOne

United States

On-site

USD 55,104 - 96,432

Full time

14 days+
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

AuraOne is seeking a Jailbreak Exploit Security Evaluator contractor to help harden AI systems by thinking like attackers, documenting failures with rigor, and patching gaps before deployment.

You will design adversarial prompts, document attack steps and violated policies, and score defenses across turn-based conversations, ensuring safe model behavior and robust defenses for customers.

Qualifications

  • Demonstrated experience red-teaming AI systems, security research, or adversarial ML work.
  • Strong written communication — your reports become the patch ticket.
  • Comfort working in policy-grey areas with clear documentation of what was attempted and why.
  • Familiarity with prompt-injection, jailbreak, and policy-bypass taxonomies.
  • Reliable async availability for at least 10 hours per week.

Responsibilities

  • Design adversarial prompts that probe known weakness classes (jailbreak, policy bypass, prompt injection) for Jailbreak Exploit Security Evaluator assignments.
  • Document every successful attack with reproduction steps and the policy clause it violated.
  • Score model defenses across single-turn and multi-turn conversations.
  • Triage emerging attack vectors and route them to the safety team with severity ratings.
  • Maintain a personal library of attack patterns and propose new red-team rubrics.
  • Calibrate against the broader red-team cohort to keep coverage and severity consistent.

Skills

Adversarial prompting
Red-team analysis
Policy taxonomy
Failure documentation
Jailbreak Exploit Security evaluation
Security review
Adversarial testing
Threat modeling
Jailbreak
Exploit

Job description

AuraOne is seeking a Jailbreak Exploit Security Evaluator contractor to help harden AI systems by thinking like attackers, documenting failures with rigor, and patching gaps before deployment.

You will design adversarial prompts, document attack steps and violated policies, and score defenses across turn-based conversations, ensuring safe model behavior and robust defenses for customers.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Remote AI Safety Evaluator - Adversarial Prompts Jailbreaks
Remote AI Safety Evaluator - Adversarial Prompts Jailbreaks

AuraOne • United States

On-site
USD 52,000 - 58,000
Remote AI Adversarial Red Teamer – Jailbreak Scenarios
Remote AI Adversarial Red Teamer – Jailbreak Scenarios

AuraOne • United States

On-site
USD 55,104 - 165,312
Contractor engagement
Remote work eligible (US)
Adversarial Prompt Security Evaluator (Remote)
Adversarial Prompt Security Evaluator (Remote)

AuraOne • United States

On-site
USD 82,656 - 165,312
Remote Adversarial AI Risk Evaluator (Red‑Team)
Remote Adversarial AI Risk Evaluator (Red‑Team)

AuraOne • United States

On-site
USD 82,656 - 123,984
Remote Adversarial AI Security Researcher
Remote Adversarial AI Security Researcher

AuraOne • United States

On-site
USD 120,000 - 180,000
Remote Adversarial Prompt Expert - Contractor
Remote Adversarial Prompt Expert - Contractor

AuraOne • United States

On-site
USD 82,656 - 137,760
Vulnerability Researcher, AI Adversarial Testing (Remote)
Vulnerability Researcher, AI Adversarial Testing (Remote)

AuraOne • United States

On-site
USD 83,000 - 165,000
Remote AI Adversarial Security Researcher
Remote AI Adversarial Security Researcher

AuraOne • United States

On-site
USD 96,000 - 124,000
Remote AI Adversarial QA Specialist
Remote AI Adversarial QA Specialist

AuraOne • United States

On-site
USD 82,656 - 165,312
Remote AI Adversarial Prompting Red Teamer
Remote AI Adversarial Prompting Red Teamer

AuraOne • United States

On-site
USD 96,432 - 179,088