Researcher – Safety Training, National Security

Jobtailor

California (MO)

On-site

USD 140,000 - 210,000

Full time

7 days ago
Be an early applicant
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

Jobtailor is seeking an AI safety researcher to advance methods for safety training, RLHF, and model robustness. You will develop evaluations, identify failure modes, and collaborate with cross-functional teams to support safe deployment for national security applications.

The role requires 4+ years in AI safety research, a CS/ML degree, and active TS/SCI clearance. You will train and evaluate models used in government contexts and contribute to policy-aligned outcomes.

Qualifications

  • 4+ years of AI safety research experience, including RLHF, adversarial training, or robustness.
  • A degree in computer science, machine learning, or a related field
  • Strong deep learning research or engineering skills
  • Experience improving model safety for deployment
  • Active TS/SCI clearance or equivalent
  • Motivation to support the responsible use of AI in safety-critical settings

Responsibilities

  • Research and implement methods for safety training, reinforcement learning, and adversarial robustness
  • Develop evaluations and identify model failure modes
  • Use evaluation findings to improve training
  • Work with research, engineering, security, and policy partners to support safe, reliable deployment
  • Train and evaluate models for U.S. government use, with a focus on national security applications
  • Advance safety post-training and robustness while helping models follow nuanced policies and preserve usefulness and capabilities

Skills

AI safety research
RLHF
Adversarial training
Deep learning research
TS/SCI clearance

Education

CS/ML degree or related field

Tools

Reinforcement Learning
Adversarial Robustness
Model Evaluation
Model Safety Improvement
Deep Learning Engineering

Job description


  • Research and implement methods for safety training, reinforcement learning, and adversarial robustness

  • Develop evaluations and identify model failure modes

  • Use evaluation findings to improve training

  • Work with research, engineering, security, and policy partners to support safe, reliable deployment

  • Train and evaluate models for U.S. government use, with a focus on national security applications

  • Advance safety post-training and robustness while helping models follow nuanced policies and preserve usefulness and capabilities


Requirements


  • 4+ years of relevant AI safety research experience, including RLHF, adversarial training, or robustness

  • A degree in computer science, machine learning, or a related field

  • Strong deep learning research or engineering skills

  • Experience improving model safety for deployment

  • Active TS/SCI clearance or equivalent

  • Motivation to support the responsible use of AI in safety-critical settings


Core Competencies

Demonstrates expertise in AI safety research, focusing on reinforcement learning, adversarial training, and model robustness. Proven ability to collaborate with cross-functional teams to enhance model safety for national security applications.


Highest-signal resume keywords


  • AI Safety Research Experience

  • Reinforcement Learning from Human Feedback (RLHF)

  • Adversarial Training

  • Deep Learning Research

  • Active TS/SCI Clearance


Hard Skills


  • Reinforcement Learning

  • Adversarial Robustness

  • Model Evaluation

  • Model Safety Improvement

  • Deep Learning Engineering


Soft Skills


  • Collaboration

  • Motivation for Responsible AI Use


Certifications & Qualifications


  • Active TS/SCI Clearance


Industry Keywords


  • National Security Applications

  • Safety-Critical Settings

  • Model Failure Modes

  • Policy Compliance

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

Triwill Group • San Francisco (CA), Northern (KY)

Hybrid
USD 180,000 - 260,000
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

OpenAI • Washington

On-site
USD 150,000 - 210,000
AI Safety Researcher — RLHF & Adversarial Robustness
AI Safety Researcher — RLHF & Adversarial Robustness

Jobtailor • California (MO)

On-site
USD 140,000 - 210,000
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

OpenAI • San Francisco (CA)

On-site
USD 380,000 - 500,000
Equity
Remote work option
AI Safety Researcher: Training & Robustness
AI Safety Researcher: Training & Robustness

Triwill Group • San Francisco (CA), Northern (KY)

Hybrid
USD 180,000 - 260,000
Researcher, Safety Training, National Security
Researcher, Safety Training, National Security

OpenAI • United States

On-site
USD 380,000 - 500,000
AI Security Engineer – Mid
AI Security Engineer – Mid

Jobtailor • Washington

On-site
USD 140,000 - 190,000
Senior AI Engineer, Security Infrastructure
Senior AI Engineer, Security Infrastructure

Jobtailor • Pennsylvania

On-site
USD 180,000 - 260,000
AI Safety Specialist - Evaluation Expert
AI Safety Specialist - Evaluation Expert

Obsidian • San Francisco (CA)

On-site
USD 120,000 - 160,000
null
AI Safety Specialist - Evaluation Expert
AI Safety Specialist - Evaluation Expert

Obsidian • New York (NY)

On-site
USD 120,000 - 180,000