Remote AI Safety Red Teamer - Adversarial Prompting

Mercor

Roma

In loco

EUR 84.000 - 100.000

Tempo pieno

14 giorni+
Generatore di candidature

Non inviare un curriculum generico — genera un curriculum e una lettera di presentazione personalizzati per questo specifico impiego.

Supera i filtri ATS

Descrizione del lavoro

Mercor is seeking an AI Safety Red Teamer for contract work to stress-test frontier AI models and identify unsafe behaviors. The role emphasizes documenting vulnerabilities and contributing to red-teaming efforts for safety benchmarking.

You will design adversarial prompts, evaluate model robustness, and collaborate with AI researchers to improve alignment across diverse, sensitive domains. Remote contract with competitive hourly compensation.

Competenze

  • Bachelor's degree or higher in a related discipline.
  • 5+ years of professional experience in AI Safety or a related field.
  • Strong analytical reasoning, prompt design, and written communication skills.
  • Experience designing adversarial prompts or evaluating frontier AI systems.

Mansioni

  • Design adversarial prompts to stress-test frontier AI models.
  • Identify jailbreaks, unsafe behaviors, hallucinations, and policy failures.
  • Evaluate model robustness across misinformation, cyber, biosecurity, fraud, political content, and other sensitive domains.
  • Document vulnerabilities and contribute to safety benchmarking and red-teaming reports.
  • Collaborate with AI researchers to improve model alignment, robustness, and safety.

Conoscenze

AI Safety
Red Teaming
Cybersecurity
Prompt design
Analytical reasoning
Written communication

Formazione

Bachelor's degree or higher in CS/Cybersecurity/related fields

Descrizione del lavoro

Mercor is seeking an AI Safety Red Teamer for contract work to stress-test frontier AI models and identify unsafe behaviors. The role emphasizes documenting vulnerabilities and contributing to red-teaming efforts for safety benchmarking.

You will design adversarial prompts, evaluate model robustness, and collaborate with AI researchers to improve alignment across diverse, sensitive domains. Remote contract with competitive hourly compensation.

Ottieni la revisione del curriculum gratis e riservata.
o trascina qui il file.
Similar jobs

Offerte di lavoro simili che vale la pena confrontare

Frontier AI Safety Evaluator
Frontier AI Safety Evaluator

Mercor • Roma

Remoto
EUR 60.000 - 90.000
Remote Evaluation & Documentation Specialist
Remote Evaluation & Documentation Specialist

Mercor • Roma

Remoto
EUR 95.000 - 190.000
Frontier AI Safety & Alignment Evaluator
Frontier AI Safety & Alignment Evaluator

Obsidian • Roma

In loco
EUR 60.000 - 90.000
Remote AI Safety Tester
Remote AI Safety Tester

TSMG Holding • Roma

Remoto
EUR 26.000 - 39.000
Remote AI Trainer Lead: Data Quality & Evaluation
Remote AI Trainer Lead: Data Quality & Evaluation

YO IT Consulting • Milano

In loco
EUR 50.000 - 80.000
AI Safety Practitioner - Expert Evaluator
AI Safety Practitioner - Expert Evaluator

Mercor • Roma

In loco
EUR 65.000 - 95.000
AI Safety Specialist - Evaluation Expert
AI Safety Specialist - Evaluation Expert

Obsidian • Roma

In loco
EUR 60.000 - 90.000
Freelance Cybersecurity Analyst - AI Trainer
Freelance Cybersecurity Analyst - AI Trainer

Mindrift • Roma

Remoto
Competitive pay rates up to $34/hour
Flexible freelance work hours
Experience on advanced AI projects
Remote AI Training Lead - Data & Model Quality
Remote AI Training Lead - Data & Model Quality

YO IT Consulting • Roma

In loco
EUR 34.440 - 55.104
Remote AI Security Advisor — Secure by Design
Remote AI Security Advisor — Secure by Design

Logistics Cluster • Roma

Ibrido
EUR 65.000 - 90.000