Frontier AI Safety Researcher

Triwill Group

San Francisco (CA)

On-site

USD 180,000 - 320,000

Full time

14 days+
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Job summary

OpenAI in San Francisco seeks exceptional researchers to push the frontier of safety mitigations, helping derisk frontier models and advance techniques from interpretability, robustness and alignment to ensure safe deployments.

This role requires deep technical experience, 2+ years in AI safety and a PhD or equivalent, plus 4+ years of research engineering with Python. You will define an end‑to‑end safety stack and collaborate across domains to advance safe AGI.

Qualifications

  • 2+ years of AI safety experience, including RLHF, human-AI collaboration, interpretability or control.
  • PhD or equivalent in computer science, machine learning, or related field.
  • 4+ years of research engineering experience with Python or similar languages.

Responsibilities

  • Identify emerging AI safety risks and mitigation methods.
  • Build and refine evaluations with domain experts to assess risks.
  • Set research directions to improve safety, alignment, and robustness.
  • Contribute to developing best practices for AI safety across the industry.
  • Evaluate end‑to‑end safety pipelines and identify areas for improvement.

Skills

RLHF
Human-AI collaboration
Interpretability
Control
Python

Education

PhD in CS/ML or related field

Job description

OpenAI in San Francisco seeks exceptional researchers to push the frontier of safety mitigations, helping derisk frontier models and advance techniques from interpretability, robustness and alignment to ensure safe deployments.

This role requires deep technical experience, 2+ years in AI safety and a PhD or equivalent, plus 4+ years of research engineering with Python. You will define an end‑to‑end safety stack and collaborate across domains to advance safe AGI.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Frontier AI Safety Researcher: Mitigations & Alignment
Frontier AI Safety Researcher: Mitigations & Alignment

OpenAI • San Francisco (CA)

On-site
USD 180,000 - 280,000
Frontier AI Safety Researcher (Hybrid — SF)
Frontier AI Safety Researcher (Hybrid — SF)

AI Chopping Block • San Francisco (CA), Northern (KY)

Hybrid
USD 180,000 - 240,000
Hybrid work model
Relocation assistance
Frontier AI Safety Researcher
Frontier AI Safety Researcher

Triwill Group • San Francisco (CA), Northern (KY)

Hybrid
USD 190,000 - 230,000
Relocation assistance
Frontier-Model Safety Researcher & Evaluations
Frontier-Model Safety Researcher & Evaluations

OpenAI • San Francisco (CA)

Hybrid
USD 380,000 - 500,000
Relocation assistance
Hybrid work model
Researcher, Frontier Risk Mitigations
Researcher, Frontier Risk Mitigations

OpenAI • San Francisco (CA)

On-site
USD 180,000 - 280,000
Frontier AI Evaluation Scientist
Frontier AI Evaluation Scientist

Neura Market • San Francisco (CA)

On-site
USD 200,000 - 250,000
Researcher, Safety Oversight
Researcher, Safety Oversight

OpenAI • Los Angeles (CA)

On-site
USD 120,000 - 150,000
Researcher, Frontier Risk Mitigations
Researcher, Frontier Risk Mitigations

Triwill Group • San Francisco (CA)

On-site
USD 180,000 - 320,000
Frontier AI Safety Evaluator & Alignment Expert
Frontier AI Safety Evaluator & Alignment Expert

Obsidian • New York (NY)

On-site
USD 120,000 - 180,000
Frontier AI Safety Evaluator
Frontier AI Safety Evaluator

Obsidian • San Francisco (CA)

Remote
USD 150,000 - 210,000