Remote AI Safety Red Teamer - Adversarial Testing

Mercor

Madrid

Presencial

EUR 84.000 - 100.000

A tiempo parcial

Hace 11 días

Recibe más respuestas de empleadores

Envía un currículum específico para el puesto de trabajo en cuestión de minutos.

Descripción de la vacante

Mercor is seeking an AI Safety Red Teamer for remote engagement. You will design adversarial prompts to stress-test frontier AI models and identify jailbreaks, unsafe behaviors, hallucinations, and policy failures.

You will evaluate model robustness across domains like misinformation, cyber, biosecurity, fraud, political content, and other sensitive areas, documenting vulnerabilities and contributing to safety benchmarking and red-teaming reports.

Formación

  • Bachelor's degree or higher in a related discipline.
  • 5+ years of professional experience in AI Safety or related field.
  • Strong analytical reasoning, prompt design, and written communication skills.
  • Experience designing adversarial prompts or evaluating frontier AI systems.

Responsabilidades

  • Design adversarial prompts to stress-test frontier AI models.
  • Identify jailbreaks, unsafe behaviors, hallucinations, and policy failures.
  • Evaluate model robustness across misinformation, cyber, biosecurity, fraud, political content, and other sensitive domains.
  • Document vulnerabilities and contribute to safety benchmarking and red-teaming reports.
  • Collaborate with AI researchers to improve model alignment, robustness, and safety.

Conocimientos

Analytical reasoning
Prompt design
Written communication
Adversarial prompts design

Educación

Bachelor’s degree or higher in relevant field

Descripción del empleo

Mercor is seeking an AI Safety Red Teamer for remote engagement. You will design adversarial prompts to stress-test frontier AI models and identify jailbreaks, unsafe behaviors, hallucinations, and policy failures.

You will evaluate model robustness across domains like misinformation, cyber, biosecurity, fraud, political content, and other sensitive areas, documenting vulnerabilities and contributing to safety benchmarking and red-teaming reports.

Consigue la evaluación confidencial y gratuita de tu currículum.
o arrastra y suelta tu archivo aquí
Similar jobs

Puestos de trabajo similares que vale la pena comparar

Frontier AI Safety Red Teamer
Frontier AI Safety Red Teamer

Mercor • Madrid

A distancia
EUR 100.000 - 140.000
Frontier AI Safety Red Team Specialist
Frontier AI Safety Red Team Specialist

Mercor • Madrid

A distancia
EUR 60.000 - 100.000
Remote AI Safety Red Team Tester
Remote AI Safety Red Team Tester

Alignerr • España

Presencial
EUR 28.000 - 55.000
Fully remote
Freelance autonomy
Remote AI Safety Evaluator - Expert Risk & Alignment Review
Remote AI Safety Evaluator - Expert Risk & Alignment Review

Mercor • Madrid

Presencial
EUR 109.000 - 128.000
Frontier AI Safety & Evaluation Specialist
Frontier AI Safety & Evaluation Specialist

Mercor • Madrid

A distancia
EUR 60.000 - 90.000
Frontier AI Safety Evaluator & Policy Feedback Lead
Frontier AI Safety Evaluator & Policy Feedback Lead

Mercor • Madrid

Presencial
EUR 55.000 - 90.000
Frontier AI Safety Evaluator & Alignment Expert
Frontier AI Safety Evaluator & Alignment Expert

Mercor • Madrid

Presencial
EUR 70.000 - 110.000
Lead IT Security AI-Redteamer
Lead IT Security AI-Redteamer

DKB Code Factory GmbH • España

Presencial
EUR 110.000 - 170.000
Lead AI-Driven Red Team Security Engineer
Lead AI-Driven Red Team Security Engineer

Dkbcodefactory • España

Presencial
EUR 90.000 - 150.000
Benefits package
Frontier AI Safety Evaluator & Alignment Specialist
Frontier AI Safety Evaluator & Alignment Specialist

Obsidian • Madrid

Presencial
EUR 90.000 - 130.000