AI Adversarial Specialist - Fully Remote | Upto $22/hr

Visa Hunt

San Francisco (CA)

Hybrid

CAD 38,000 - 42,000

Part time

14 days+
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Job summary

Mercor is seeking AI Safety Experts for a remote contract role. You will red-team conversational AI models, identify jailbreaks and bias, and generate high-quality data for robust evaluation.

You will document results, craft reports and attack cases, and collaborate asynchronously across projects, applying playbooks and taxonomies to ensure repeatable testing and clear risk communication.

Qualifications

  • Fluent in English and Bengali.
  • Prior red teaming experience in AI adversarial work, cybersecurity, or socio-technical probing.
  • Strong communication skills for explaining risks to technical and non-technical stakeholders.

Responsibilities

  • Red team conversational AI models and agents. Focus on jailbreaks, prompt injections, misuse cases, and bias exploitation.
  • Generate high-quality human data. Annotate failures, classify vulnerabilities, and flag systemic risks.
  • Apply structure using taxonomies, benchmarks, and playbooks for consistent testing.
  • Document reproducibly. Produce reports, datasets, and attack cases for customer action.
  • Work independently and asynchronously. Ensure flexibility and adaptability across projects.

Skills

English
Bengali
AI adversarial work
Cybersecurity
Socio-technical probing
Adversarial ML
Creative probing

Job description

About the job

Mercor connects elite creative and technical talent with leading AI research labs. Headquartered in San Francisco, our investors include Benchmark, General Catalyst, Peter Thiel, Adam D'Angelo, Larry Summers, and Jack Dorsey.

Position: AI Safety Experts — English & Bengali
Type:Contract
Compensation:$20–$22/hour
Location:Remote

Role Responsibilities
  • Red team conversational AI models and agents. Focus on jailbreaks, prompt injections, misuse cases, and bias exploitation.
  • Generate high-quality human data. Annotate failures, classify vulnerabilities, and flag systemic risks.
  • Apply structure using taxonomies, benchmarks, and playbooks for consistent testing.
  • Document reproducibly. Produce reports, datasets, and attack cases for customer action.
  • Work independently and asynchronously. Ensure flexibility and adaptability across projects.
Qualifications

Must-Have

  • Fluent in English and Bengali.
  • Prior red teaming experience in AI adversarial work, cybersecurity, or socio-technical probing.
  • Strong communication skills for explaining risks to technical and non-technical stakeholders.
Preferred
  • Experience with adversarial ML, cybersecurity, and socio-technical risk.
  • Skills in creative probing like psychology, acting, or writing for unconventional adversarial thinking.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

AI Adversarial Specialist - Fully Remote | Upto $62/hr
AI Adversarial Specialist - Fully Remote | Upto $62/hr

mercor • San Francisco (CA)

Hybrid
CAD 92,000 - 119,000
AI Safety Specialist - Fully Remote | Upto $62/hr
AI Safety Specialist - Fully Remote | Upto $62/hr

Visa Hunt • Town of Belgium (WI)

Remote
USD 66,000 - 85,000
AI Safety Specialist - Fully Remote - Upto $62/hr
AI Safety Specialist - Fully Remote - Upto $62/hr

mercor • San Francisco (CA)

Hybrid
GBP 49,000 - 63,000
Ai Safety Expert - Bilingual
Ai Safety Expert - Bilingual

Mercor • San Francisco (CA)

Hybrid
AUD 29,000 - 48,000
AI Safety Specialist - Remote | Upto $84/hr
AI Safety Specialist - Remote | Upto $84/hr

United States Digital Space LLC • United States

Remote
USD 96,000 - 116,000
AI Security Specialist (English & Chinese) | $50.5/hr Remote
AI Security Specialist (English & Chinese) | $50.5/hr Remote

Crossing Hurdles • United States

Remote
AI Red Team Analyst (LLM Safety & Adversarial Testing) | $26/hr Remote
AI Red Team Analyst (LLM Safety & Adversarial Testing) | $26/hr Remote

Crossing Hurdles • United States

Remote
AI Red Team Specialist — Adversarial Testing (Remote)
AI Red Team Specialist — Adversarial Testing (Remote)

Mercor • San Francisco (CA)

Remote
USD 130,000 - 170,000
AI Safety Specialist - Fully Remote | Upto $35/hr
AI Safety Specialist - Fully Remote | Upto $35/hr

Obsidian • San Francisco (CA)

Remote
USD 90,000 - 130,000
Adversarial AI Testing Specialist (LLM Red Teaming) | $28.74/hr Remote
Adversarial AI Testing Specialist (LLM Red Teaming) | $28.74/hr Remote

Crossing Hurdles • United States

Remote