AI Safety Training Researcher – National Security (Remote)

OpenAI

San Francisco (CA)

On-site

USD 380,000 - 500,000

Full time

2 days ago
Be an early applicant
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Benefits offered by this job

Equity
Remote work option

Job summary

OpenAI is seeking a Researcher in Safety Training for National Security to advance post-training safety, harness robust policies, and ensure useful behavior in high-stakes government contexts.

You will train and evaluate models for U.S. government use, collaborating with research, engineering, security, and policy partners to deploy safe, reliable systems while advancing safety post-training and robustness.

Qualifications

  • 4+ years of AI safety research experience, including RLHF or robustness work.
  • Strong deep learning research or engineering skills.
  • Experience improving model safety for deployment.
  • Aligned with OpenAI’s mission and responsible AI use.

Responsibilities

  • Research and implement methods for safety training and robustness.
  • Develop evaluations and identify model failure modes to improve training.
  • Collaborate with research, engineering, security, and policy partners to support safe deployment.

Skills

AI safety research
RLHF
Adversarial training
Robustness

Education

Degree in computer science, machine learning, or related field

Job description

OpenAI is seeking a Researcher in Safety Training for National Security to advance post-training safety, harness robust policies, and ensure useful behavior in high-stakes government contexts.

You will train and evaluate models for U.S. government use, collaborating with research, engineering, security, and policy partners to deploy safe, reliable systems while advancing safety post-training and robustness.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

AI Safety Researcher: Robust Training for National Security
AI Safety Researcher: Robust Training for National Security

OpenAI • Washington

On-site
USD 150,000 - 210,000
AI Safety Researcher: Training & Robustness
AI Safety Researcher: Training & Robustness

Triwill Group • San Francisco (CA), Northern (KY)

Hybrid
USD 180,000 - 260,000
AI Safety Training Researcher — Robustness Focus
AI Safety Training Researcher — Robustness Focus

OpenAI • United States

On-site
USD 380,000 - 500,000
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

OpenAI • San Francisco (CA)

On-site
USD 380,000 - 500,000
Equity
Remote work option
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

OpenAI • Washington

On-site
USD 150,000 - 210,000
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

Triwill Group • San Francisco (CA), Northern (KY)

Hybrid
USD 180,000 - 260,000
AI Safety Researcher — RLHF & Adversarial Robustness
AI Safety Researcher — RLHF & Adversarial Robustness

Jobtailor • California (MO)

On-site
USD 140,000 - 210,000
AI Safety & Post-Training Scientist
AI Safety & Post-Training Scientist

Scale • San Francisco (CA), New York (NY)

On-site
USD 216,000 - 270,000
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

OpenAI • United States

On-site
USD 380,000 - 500,000
AI Safety & Oversight Systems Researcher
AI Safety & Oversight Systems Researcher

OpenAI • San Francisco (CA)

Hybrid
USD 195,000 - 230,000
Relocation assistance
Hybrid work model