Frontier AI Safety Researcher

Triwill Group

San Francisco, Northern (CA, KY)

Hybrid

USD 190,000 - 230,000

Full time

12 days ago
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Benefits offered by this job

Relocation assistance

Job summary

OpenAI is seeking strong executors with excellent judgment for a role focused on training and evaluating frontier models to reduce harmful agent actions. The position emphasizes building scalable measurement and evaluation systems and collaborating across post-training, capabilities, oversight, and pre-training teams.

Hybrid work in San Francisco, CA with relocation assistance, welcoming candidates even if they come from outside formal safety or alignment backgrounds.

Qualifications

  • Strong executors with excellent judgment and comfort with ambiguity.
  • Understanding of frontier model research.
  • Open to contributing even without prior safety/alignment experience.

Responsibilities

  • Train and evaluate frontier models to reduce harmful or misaligned agent actions, forming hypotheses and executing through ambiguity.
  • Mine incidents and build scalable measurement, data-processing, and evaluation systems for safety signals.
  • Collaborate with post-training, capabilities, oversight, and pre-training teams to ship mitigations into large-scale training and agent systems.

Skills

Research engineering
ML engineering
Quantitative research
Applied model research
Experimentation
Data processing
Evaluation
Infrastructure
Ambiguity tolerance
Safety/alignment interest

Tools

Post-training coordination tools
Large-scale training systems

Job description

OpenAI is seeking strong executors with excellent judgment for a role focused on training and evaluating frontier models to reduce harmful agent actions. The position emphasizes building scalable measurement and evaluation systems and collaborating across post-training, capabilities, oversight, and pre-training teams.

Hybrid work in San Francisco, CA with relocation assistance, welcoming candidates even if they come from outside formal safety or alignment backgrounds.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Frontier AI Safety Researcher (Hybrid — SF)
Frontier AI Safety Researcher (Hybrid — SF)

AI Chopping Block • San Francisco (CA), Northern (KY)

Hybrid
USD 180,000 - 240,000
Hybrid work model
Relocation assistance
Frontier AI Safety Researcher: Mitigations & Alignment
Frontier AI Safety Researcher: Mitigations & Alignment

OpenAI • San Francisco (CA)

On-site
USD 180,000 - 280,000
Frontier AI Safety Researcher
Frontier AI Safety Researcher

Triwill Group • San Francisco (CA)

On-site
USD 180,000 - 320,000
Frontier AI Safety Evaluator & Alignment Expert
Frontier AI Safety Evaluator & Alignment Expert

Obsidian • New York (NY)

On-site
USD 120,000 - 180,000
Researcher, Agent Safety, Training and Evaluations
Researcher, Agent Safety, Training and Evaluations

AI Chopping Block • San Francisco (CA), Northern (KY)

Hybrid
USD 180,000 - 240,000
Hybrid work model
Relocation assistance
Frontier AI Evaluation Scientist
Frontier AI Evaluation Scientist

Neura Market • San Francisco (CA)

On-site
USD 200,000 - 250,000
Frontier AI Safety Evaluator
Frontier AI Safety Evaluator

Obsidian • San Francisco (CA)

Remote
USD 150,000 - 210,000
Researcher, Agent Safety, Training and Evaluations
Researcher, Agent Safety, Training and Evaluations

Triwill Group • San Francisco (CA), Northern (KY)

Hybrid
USD 190,000 - 230,000
Relocation assistance
Frontier AI Safety Evaluator & Policy Expert
Frontier AI Safety Evaluator & Policy Expert

Obsidian • San Francisco (CA)

On-site
USD 140,000 - 210,000
Frontier AI Safety Evaluator & Alignment Specialist
Frontier AI Safety Evaluator & Alignment Specialist

Obsidian • San Francisco (CA)

On-site
USD 120,000 - 160,000
null