AI Safety Researcher: Robust Training for National Security

OpenAI

Washington (District of Columbia)

On-site

USD 150,000 - 210,000

Full time

6 days ago
Be an early applicant
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Job summary

OpenAI is seeking a researcher to train and evaluate models for U.S. government use, with a focus on national security applications. You will advance safety post-training and robustness, helping models follow nuanced policies while preserving their usefulness and capabilities.

You will collaborate with research, engineering, security, and policy teams to ensure safe, reliable deployment and responsible use of AI in safety-critical settings.

Qualifications

  • 4+ years of relevant AI safety research experience, including RLHF, adversarial training, or robustness.
  • Have a degree in computer science, machine learning, or a related field, and strong deep learning research or engineering skills.
  • Have experience improving model safety for deployment and enjoy collaborative research.
  • Are motivated by OpenAI's mission and the responsible use of AI in safety-critical settings.

Responsibilities

  • Research and implement methods for safety training, reinforcement learning, and adversarial robustness.
  • Develop evaluations, identify model failure modes, and use findings to improve training.
  • Work with research, engineering, security, and policy partners to support safe, reliable deployment.

Skills

AI safety research
RLHF
Adversarial training
Robustness
Deep learning

Education

Degree in Computer Science, Machine Learning or related field

Job description

OpenAI is seeking a researcher to train and evaluate models for U.S. government use, with a focus on national security applications. You will advance safety post-training and robustness, helping models follow nuanced policies while preserving their usefulness and capabilities.

You will collaborate with research, engineering, security, and policy teams to ensure safe, reliable deployment and responsible use of AI in safety-critical settings.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

AI Safety Training Researcher — Robustness Focus
AI Safety Training Researcher — Robustness Focus

OpenAI • United States

On-site
USD 380,000 - 500,000
AI Safety Researcher: Training & Robustness
AI Safety Researcher: Training & Robustness

Triwill Group • San Francisco (CA), Northern (KY)

Hybrid
USD 180,000 - 260,000
AI Safety Training Researcher – National Security (Remote)
AI Safety Training Researcher – National Security (Remote)

OpenAI • San Francisco (CA)

On-site
USD 380,000 - 500,000
Equity
Remote work option
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

OpenAI • Washington

On-site
USD 150,000 - 210,000
AI Safety Researcher — RLHF & Adversarial Robustness
AI Safety Researcher — RLHF & Adversarial Robustness

Jobtailor • California (MO)

On-site
USD 140,000 - 210,000
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

Triwill Group • San Francisco (CA), Northern (KY)

Hybrid
USD 180,000 - 260,000
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

OpenAI • San Francisco (CA)

On-site
USD 380,000 - 500,000
Equity
Remote work option
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

OpenAI • United States

On-site
USD 380,000 - 500,000
Researcher – Safety Training, National Security
Researcher – Safety Training, National Security

Jobtailor • California (MO)

On-site
USD 140,000 - 210,000
AI Safety & Oversight Systems Researcher
AI Safety & Oversight Systems Researcher

OpenAI • San Francisco (CA)

Hybrid
USD 195,000 - 230,000
Relocation assistance
Hybrid work model