Remote LLM Safety & Red Teaming Expert

Weekday 1

United States

Remote

USD 69,000 - 124,000

Part time

14 days+
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Job summary

Weekday 1 is seeking an experienced AI Safety & Red Teaming Specialist for a remote contract. You will assess adversarial AI risks, design evaluation methodologies, and improve the robustness of large language models against real-world threats.

This role emphasizes ethical hacking, rigorous testing, and transparent reporting. Collaborate with cross-functional teams to translate security findings into concrete recommendations, develop regression test suites, and document testing approaches for

Qualifications

  • 2+ years of experience in AI Safety, Adversarial ML, or related field.
  • Hands-on experience researching prompts, jailbreaks, adversarial attacks, or tool-use.
  • Strong understanding of modern LLM architectures and safety evaluation methodologies.
  • Experience developing security assessments, regression testing, and adversarial evaluation strategies.
  • Excellent analytical and communication skills; ability to explain complex findings clearly.
  • Ability to collaborate within cross-functional teams.

Responsibilities

  • Design and implement advanced evaluation methodologies for AI system safety, including ethical jailbreak testing, prompt injection detection, LLM red teaming, and tool-use abuse scenarios.
  • Develop cross-domain adversarial testing strategies to uncover complex, multi-turn attack patterns and model vulnerabilities.
  • Build, maintain, and enhance regression test suites to continuously assess jailbreak susceptibility and prompt injection risks.
  • Create comprehensive evaluation frameworks that simulate real-world adversarial threats to improve AI robustness and reliability.
  • Collaborate with technical teams to translate security findings into actionable recommendations for AI safety improvements.
  • Document testing methodologies, findings, and best practices through clear technical reports and presentations for both technical and non-technical stakeholders.

Skills

AI Safety
LLM Red Teaming
Prompt Injection
Adversarial Machine Learning

Education

Master's or PhD in CS/Cybersecurity/ML/AI

Job description

Weekday 1 is seeking an experienced AI Safety & Red Teaming Specialist for a remote contract. You will assess adversarial AI risks, design evaluation methodologies, and improve the robustness of large language models against real-world threats.

This role emphasizes ethical hacking, rigorous testing, and transparent reporting. Collaborate with cross-functional teams to translate security findings into concrete recommendations, develop regression test suites, and document testing approaches for

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Remote AI Safety & Red Teaming Expert
Remote AI Safety & Red Teaming Expert

Weekday AI (YC W21) • United States

On-site
USD 68,880 - 123,984
Remote LLM Red Team Engineer: Edge Cases & Failures
Remote LLM Red Team Engineer: Edge Cases & Failures

Weekday 1 • United States

Remote
USD 83,000 - 124,000
Fully remote
Weekly payments
AI Safety & Red Teaming Specialist
AI Safety & Red Teaming Specialist

Weekday 1 • United States

Remote
USD 69,000 - 124,000
Remote AI Safety Red Team Specialist
Remote AI Safety Red Team Specialist

Neon • United States

Remote
USD 90,000 - 140,000
AI Safety Red Team Specialist (Remote)
AI Safety Red Team Specialist (Remote)

Mercor • San Francisco (CA)

On-site
USD 90,000 - 130,000
Remote AI Red Team - Safety & Adversarial Testing
Remote AI Red Team - Safety & Adversarial Testing

Obsidian • San Francisco (CA)

On-site
USD 100,000 - 140,000
Remote AI Safety Red Team Specialist
Remote AI Safety Red Team Specialist

Mercor • San Francisco (CA)

On-site
USD 120,000 - 180,000
Remote AI Safety Red Team Specialist
Remote AI Safety Red Team Specialist

Mercor • San Francisco (CA)

Remote
USD 120,000 - 180,000
Remote AI Safety Red Team Expert (EN/Malay)
Remote AI Safety Red Team Expert (EN/Malay)

Mercor • New York (NY)

Remote
USD 120,000 - 180,000
Remote AI Red Teamer - LLM Generalist (Stress-Test)
Remote AI Red Teamer - LLM Generalist (Stress-Test)

Apply • Northern (KY)

Hybrid
USD 120,000 - 180,000