Remote AI Adversarial Safety Specialist (English & Vietnamese)

Mercor

Philippines

On-site

PHP 1,439,000 - 2,117,000

Part time

14 days+
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Job summary

Mercor is seeking AI Safety Experts—English & Vietnamese—to safely test and probe AI systems. This remote contract role involves rigorous red teaming of conversational models and documenting findings for customers.

You’ll annotate failures, assess vulnerabilities, and communicate risks clearly to both technical and non-technical stakeholders. Prior adversarial ML or cybersecurity experience is preferred, with contributions to ethics and risk minimization.

Qualifications

  • Fluent in English and Vietnamese.
  • Prior experience in red teaming, AI adversarial work, or cybersecurity.
  • Ability to explain risks clearly to both technical and non-technical stakeholders.

Responsibilities

  • Red team conversational AI models and agents by conducting jailbreaks, prompt injections, and bias exploitation.
  • Generate high-quality human data by annotating failures, classifying vulnerabilities, and flagging systemic risks.
  • Apply structure using taxonomies, benchmarks, and playbooks to ensure consistent testing.
  • Document reproducibly by producing reports, datasets, and attack cases for customer action.
  • Review AI outputs on sensitive topics like bias and misinformation, with optional participation in higher-sensitivity projects.

Skills

English fluency
Vietnamese fluency
Red teaming
Risk communication
Adversarial ML
Cybersecurity
Creative probing
Stakeholder communication

Job description

Mercor is seeking AI Safety Experts—English & Vietnamese—to safely test and probe AI systems. This remote contract role involves rigorous red teaming of conversational models and documenting findings for customers.

You’ll annotate failures, assess vulnerabilities, and communicate risks clearly to both technical and non-technical stakeholders. Prior adversarial ML or cybersecurity experience is preferred, with contributions to ethics and risk minimization.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Remote AI Safety Red Team Specialist
Remote AI Safety Red Team Specialist

Obsidian • Quezon City

On-site
PHP 5,478,000 - 9,130,000
Remote AI Adversarial Tester (English/Vietnamese)
Remote AI Adversarial Tester (English/Vietnamese)

Mercor • Philippines

Remote
USD 90,000 - 150,000
AI Adversarial Specialist - Fully Remote
AI Adversarial Specialist - Fully Remote

Mercor • Philippines

Remote
USD 90,000 - 150,000
Remote AI Safety & Adversarial Red Team Expert
Remote AI Safety & Adversarial Red Team Expert

Mercor • Philippines

On-site
PHP 4,316,000 - 6,782,000
AI Red Team Specialist — Adversarial Testing (Remote)
AI Red Team Specialist — Adversarial Testing (Remote)

Mercor • Quezon City

Remote
PHP 3,652,000 - 7,304,000
Remote AI Safety Red Team Specialist
Remote AI Safety Red Team Specialist

Mercor • Quezon City

On-site
PHP 600,000 - 1,200,000
Remote AI Safety Red Team Engineer
Remote AI Safety Red Team Engineer

Mercor • Philippines

On-site
PHP 600,000 - 900,000
Remote AI SaaS Customer Success Engineer
Remote AI SaaS Customer Success Engineer

HumanitApp • Hinoba-an

On-site
PHP 1,881,000 - 2,821,000
Elite GenAI Specialist: Adversarial & Prompt Design Remote
Elite GenAI Specialist: Adversarial & Prompt Design Remote

Alice • España

Hybrid
EUR 40,000 - 60,000
Remote IT Risk & Assurance Manager for AI Governance
Remote IT Risk & Assurance Manager for AI Governance

Ethos • Philippines

On-site
PHP 6,663,000 - 8,999,000