AI Safety Training Researcher — Robustness Focus

OpenAI

United States

On-site

USD 380,000 - 500,000

Full time

3 days ago
Be an early applicant
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Job summary

OpenAI in the United States seeks a researcher to train and evaluate models for U.S. government use, focusing on national security applications. You will advance safety post-training and robustness, helping models follow nuanced policies while preserving usefulness.

Join a collaborative team advancing safety through research, engineering, and policy partnerships to deploy safe, reliable AI systems.

Qualifications

  • 4+ years of AI safety research experience (e.g., RLHF, adversarial training, robustness)
  • Degree in computer science, machine learning, or a related field
  • Strong deep learning research or engineering skills
  • Experience deploying AI safety improvements in models or products
  • Security clearance or eligibility to obtain TS/SCI where required

Responsibilities

  • Research and implement methods for safety training, reinforcement learning, and adversarial robustness.
  • Develop evaluations, identify model failure modes, and use findings to improve training.
  • Work with research, engineering, security, and policy partners to support safe, reliable deployment

Skills

Reinforcement learning
Adversarial robustness
Safety training methods
Deep learning
Python
PyTorch

Education

Bachelor's degree in CS/ML or related field

Tools

Python
PyTorch

Job description

OpenAI in the United States seeks a researcher to train and evaluate models for U.S. government use, focusing on national security applications. You will advance safety post-training and robustness, helping models follow nuanced policies while preserving usefulness.

Join a collaborative team advancing safety through research, engineering, and policy partnerships to deploy safe, reliable AI systems.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

AI Safety Researcher: Robust Training for National Security
AI Safety Researcher: Robust Training for National Security

OpenAI • Washington

On-site
USD 150,000 - 210,000
AI Safety Researcher: Training & Robustness
AI Safety Researcher: Training & Robustness

Triwill Group • San Francisco (CA), Northern (KY)

Hybrid
USD 180,000 - 260,000
AI Safety Training Researcher – National Security (Remote)
AI Safety Training Researcher – National Security (Remote)

OpenAI • San Francisco (CA)

On-site
USD 380,000 - 500,000
Equity
Remote work option
AI Safety Researcher — RLHF & Adversarial Robustness
AI Safety Researcher — RLHF & Adversarial Robustness

Jobtailor • California (MO)

On-site
USD 140,000 - 210,000
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

OpenAI • Washington

On-site
USD 150,000 - 210,000
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

OpenAI • San Francisco (CA)

On-site
USD 380,000 - 500,000
Equity
Remote work option
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

Triwill Group • San Francisco (CA), Northern (KY)

Hybrid
USD 180,000 - 260,000
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

OpenAI • United States

On-site
USD 380,000 - 500,000
AI Safety & Oversight Systems Researcher
AI Safety & Oversight Systems Researcher

OpenAI • San Francisco (CA)

Hybrid
USD 195,000 - 230,000
Relocation assistance
Hybrid work model
Frontier-Model Safety Researcher & Evaluations
Frontier-Model Safety Researcher & Evaluations

OpenAI • San Francisco (CA)

Hybrid
USD 380,000 - 500,000
Relocation assistance
Hybrid work model