Frontier AI Evaluation & Environments Engineer

OpenAI

California (MO)

On-site

USD 180,000 - 240,000

Full time

14 days+
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Job summary

OpenAI is seeking a Researcher for Frontier Evals & Environments to help create north star model environments that drive progress toward safe AGI/ASI. You will guide research programs behind OpenAI’s ambitious training runs and work with researchers, engineers, product teams, infrastructure, and safety partners.

You will help decide what goes into major model runs, measure outcomes, and ship improvements that affect products used by developers, enterprises, and everyday users.

Qualifications

  • Strong technical fundamentals in machine learning, software engineering, systems, or statistics.
  • Hands-on experience with LLMs, RL, RLHF/RLAIF, post-training, evals, graders, synthetic data, or production ML systems.
  • Comfortable with open-ended problems requiring research taste and engineering execution.

Responsibilities

  • Create ambitious RL environments to push models to their limits and measure frontier model capabilities, skills, and behaviors.
  • Develop new methodologies for automatically exploring model behavior.
  • Dive deep into the science of measurement, including scalability, reliability, and variance of evaluation methods.
  • Help steer training for large runs and see future implications of improvements.
  • Design scalable systems and processes to support continuous evaluation.
  • Build self-improvement loops to automate model understanding.

Skills

ML fundamentals
Software engineering
Systems
Statistics
LLMs
RL/RLHF
Post-training evals
Tool-using agents
Production ML

Job description

OpenAI is seeking a Researcher for Frontier Evals & Environments to help create north star model environments that drive progress toward safe AGI/ASI. You will guide research programs behind OpenAI’s ambitious training runs and work with researchers, engineers, product teams, infrastructure, and safety partners.

You will help decide what goes into major model runs, measure outcomes, and ship improvements that affect products used by developers, enterprises, and everyday users.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Frontier AI Evaluation Scientist
Frontier AI Evaluation Scientist

Neura Market • San Francisco (CA)

On-site
USD 200,000 - 250,000
Frontier AI Evaluation & Environments Researcher
Frontier AI Evaluation & Environments Researcher

OpenAI • California (MO)

On-site
USD 180,000 - 230,000
Frontier AI Evaluation Engineer: RL Environments
Frontier AI Evaluation Engineer: RL Environments

OpenAI • San Francisco (CA)

On-site
USD 120,000 - 160,000
Frontier AI Safety Researcher
Frontier AI Safety Researcher

Triwill Group • San Francisco (CA), Northern (KY)

Hybrid
USD 190,000 - 230,000
Relocation assistance
Research Engineer, Frontier Evals & Environments
Research Engineer, Frontier Evals & Environments

OpenAI • Los Angeles (CA)

On-site
USD 100,000 - 150,000
Research Engineer, Frontier Evals & Environments
Research Engineer, Frontier Evals & Environments

OpenAI • San Francisco (CA)

On-site
USD 120,000 - 160,000
Research Engineer, Frontier Evals & Environments
Research Engineer, Frontier Evals & Environments

OpenAI • California (MO)

On-site
USD 180,000 - 240,000
Frontier AI Safety Researcher
Frontier AI Safety Researcher

Triwill Group • San Francisco (CA)

On-site
USD 180,000 - 320,000
Frontier AI Safety Evaluator & Alignment Expert
Frontier AI Safety Evaluator & Alignment Expert

Obsidian • New York (NY)

On-site
USD 120,000 - 180,000
Agent Post-Training, Frontier Evals and Environments Research
Agent Post-Training, Frontier Evals and Environments Research

OpenAI • California (MO)

On-site
USD 180,000 - 230,000