Frontier AI Safety Researcher | Mitigations & Alignment

OpenAI

San Francisco (CA)

On-site

USD 295,000 - 445,000

Full time

12 days ago

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

OpenAI seeks exceptional researchers to push the frontier of safety mitigations for frontier models. You will help derisk models by developing novel mitigations, applying methods from interpretability, control, and alignment to ensure deployed models remain safe.

You will collaborate with experts across misalignment, cybersecurity, and biology to build a scalable safety stack and define how a safe AI system should perform in the future at OpenAI.

Qualifications

  • 2+ years of experience in AI safety or related field.
  • PhD or equivalent required for the role.
  • Experience with large-scale AI systems and safety practices is preferred.

Responsibilities

  • Identify emerging AI safety risks and develop mitigation strategies.
  • Build and refine evaluations to measure risk and safety performance.
  • Set research directions to improve safety, alignment, and robustness of AI systems.
  • Contribute to best practices guidelines for AI safety across OpenAI and the industry.
  • Design and evaluate red-teaming pipelines to test end-to-end safety.

Skills

Python
RLHF
Interpretability
Safety
Control
Robustness

Education

PhD in Computer Science / ML or related field

Job description

OpenAI seeks exceptional researchers to push the frontier of safety mitigations for frontier models. You will help derisk models by developing novel mitigations, applying methods from interpretability, control, and alignment to ensure deployed models remain safe.

You will collaborate with experts across misalignment, cybersecurity, and biology to build a scalable safety stack and define how a safe AI system should perform in the future at OpenAI.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Frontier AI Safety Researcher
Frontier AI Safety Researcher

Triwill Group • San Francisco (CA)

On-site
USD 180,000 - 320,000
Frontier AI Safety Researcher
Frontier AI Safety Researcher

United States Digital Space LLC • San Francisco (CA)

On-site
USD 150,000 - 230,000
Researcher, Frontier Risk Mitigations
Researcher, Frontier Risk Mitigations

OpenAI • San Francisco (CA)

On-site
USD 295,000 - 445,000
Frontier AI Security Researcher for Risk & Safeguards
Frontier AI Security Researcher for Risk & Safeguards

Triwill Group • San Francisco (CA), Northern (KY)

Hybrid
USD 170,000 - 260,000
Researcher, Frontier Risk Mitigations
Researcher, Frontier Risk Mitigations

Triwill Group • San Francisco (CA)

On-site
USD 180,000 - 320,000
Frontier AI Cybersecurity Risk Researcher
Frontier AI Cybersecurity Risk Researcher

OpenAI • San Francisco (CA)

On-site
USD 295,000 - 445,000
Researcher, Frontier Risk Mitigations
Researcher, Frontier Risk Mitigations

United States Digital Space LLC • San Francisco (CA)

On-site
USD 150,000 - 230,000
Frontier AI Cybersecurity Risks Researcher
Frontier AI Cybersecurity Risks Researcher

Applied Methods Ltd • San Francisco (CA)

On-site
USD 30,000 - 45,000
Frontier AI Safety Research Engineer — Risk Evaluations
Frontier AI Safety Research Engineer — Risk Evaluations

United States Digital Space LLC • San Francisco (CA)

On-site
USD 180,000 - 230,000
Frontier AI Safety Evaluator — Risk & Alignment Expert
Frontier AI Safety Evaluator — Risk & Alignment Expert

Mercor • New York (NY)

On-site
USD 120,000 - 170,000