Frontier AI Safety Researcher: Mitigations & Alignment

OpenAI

San Francisco (CA)

On-site

USD 180,000 - 280,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

OpenAI in San Francisco is seeking exceptional researchers to push the frontier of safety mitigations for deployed models. You will help derisk frontier models by developing novel safety mitigations and applying methods from interpretability, control, and alignment to ensure safe AI systems.

The role requires strong technical depth and collaboration across misalignment, cybersecurity, and biology to build an end-to-end safety stack that is scalable and enforceable at scale.

Qualifications

  • 2+ years of experience in AI safety research or related field.
  • PhD or equivalent in CS/ML is required.
  • Strong programming in Python and familiarity with ML libraries.

Responsibilities

  • Identify emerging AI safety risks and mitigation approaches.
  • Develop and refine evaluations to measure risk and safety.
  • Set research directions to improve AI safety, alignment, and robustness.
  • Contribute to best practices for AI safety across OpenAI and industry.
  • Design red-teaming pipelines to test end-to-end safety systems.

Skills

AI safety
RLHF
Interpretability
Robustness
Control
Python

Education

PhD or equivalent in CS/ML

Tools

PyTorch
TensorFlow
SciPy

Job description

OpenAI in San Francisco is seeking exceptional researchers to push the frontier of safety mitigations for deployed models. You will help derisk frontier models by developing novel safety mitigations and applying methods from interpretability, control, and alignment to ensure safe AI systems.

The role requires strong technical depth and collaboration across misalignment, cybersecurity, and biology to build an end-to-end safety stack that is scalable and enforceable at scale.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Frontier AI Safety Researcher
Frontier AI Safety Researcher

Triwill Group • San Francisco (CA)

On-site
USD 180,000 - 320,000
Researcher, Frontier Risk Mitigations
Researcher, Frontier Risk Mitigations

OpenAI • San Francisco (CA)

On-site
USD 180,000 - 280,000
Frontier AI Security Researcher for Risk & Safeguards
Frontier AI Security Researcher for Risk & Safeguards

Triwill Group • San Francisco (CA), Northern (KY)

Hybrid
USD 170,000 - 260,000
Researcher, Frontier Risk Mitigations
Researcher, Frontier Risk Mitigations

Triwill Group • San Francisco (CA)

On-site
USD 180,000 - 320,000
Frontier AI Cybersecurity Risk Researcher
Frontier AI Cybersecurity Risk Researcher

OpenAI • San Francisco (CA)

On-site
USD 295,000 - 445,000
Frontier AI Cybersecurity Risks Researcher
Frontier AI Cybersecurity Risks Researcher

Applied Methods Ltd • San Francisco (CA)

On-site
USD 30,000 - 45,000
Frontier AI Safety Evaluator & Alignment Expert
Frontier AI Safety Evaluator & Alignment Expert

Obsidian • New York (NY)

On-site
USD 120,000 - 180,000
Frontier AI Safety Evaluator & Alignment Specialist
Frontier AI Safety Evaluator & Alignment Specialist

Obsidian • San Francisco (CA)

On-site
USD 120,000 - 160,000
null
Research Scientist, AI Alignment & Safety
Research Scientist, AI Alignment & Safety

AI Breaking Wire • San Francisco (CA)

On-site
USD 300,000 - 450,000
Competitive salary and equity packages
Comprehensive health, dental, and visa
Flexible working arrangements and PTO
+1
Frontier AI Safety Policy Designer
Frontier AI Safety Policy Designer

Neura Market • San Francisco (CA)

Hybrid
USD 180,000 - 280,000