Frontier Agent Evals & Environments Research Scientist

OpenAI

San Francisco (CA)

On-site

USD 380,000 - 500,000

Full time

22 hours ago
Be an early applicant
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Job summary

OpenAI in San Francisco is seeking an Agent Post-Training researcher for Frontier Evals & Environments. You will help build north star model environments to drive progress toward safe AGI/ASI and guide the research programs behind our largest training runs.

You will collaborate with researchers, engineers, product teams, infrastructure, and safety partners to decide what goes into major model runs, measure outcomes, and ship improvements used by real people.

Responsibilities

  • Create ambitious RL environments to push our models to their limits, and measure frontier model capabilities, skills, and behaviors
  • Develop new methodologies for automatically exploring the behavior of these models
  • Dive deep into the science of measurement, including understanding scalability, reliability, and variance of our evaluation methodology
  • Help steer training for our largest training runs, and see the future first
  • Design scalable systems and processes to support continuous evaluation
  • Build self-improvement loops to automate model understanding

Job description

OpenAI in San Francisco is seeking an Agent Post-Training researcher for Frontier Evals & Environments. You will help build north star model environments to drive progress toward safe AGI/ASI and guide the research programs behind our largest training runs.

You will collaborate with researchers, engineers, product teams, infrastructure, and safety partners to decide what goes into major model runs, measure outcomes, and ship improvements used by real people.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Frontier AI Evaluation Scientist
Frontier AI Evaluation Scientist

Neura Market • San Francisco (CA)

On-site
USD 200,000 - 250,000
Frontier-Model Safety Researcher & Evaluations
Frontier-Model Safety Researcher & Evaluations

OpenAI • San Francisco (CA)

Hybrid
USD 380,000 - 500,000
Relocation assistance
Hybrid work model
Agent Post-Training, Frontier Evals and Environments Research
Agent Post-Training, Frontier Evals and Environments Research

Neura Market • San Francisco (CA)

On-site
USD 200,000 - 250,000
Frontier AI Safety Researcher
Frontier AI Safety Researcher

Triwill Group • San Francisco (CA), Northern (KY)

Hybrid
USD 190,000 - 230,000
Relocation assistance
Agent Post-Training, Frontier Evals and Environments Research
Agent Post-Training, Frontier Evals and Environments Research

OpenAI • San Francisco (CA)

On-site
USD 380,000 - 500,000
Context Researcher for Frontier Agent Training
Context Researcher for Frontier Agent Training

OpenAI • San Francisco (CA)

On-site
USD 380,000 - 500,000
Research Engineer - Frontier AI Training & Evals
Research Engineer - Frontier AI Training & Evals

Visa Hunt • San Francisco (CA), Northern (KY)

Hybrid
USD 140,000 - 200,000
Competitive compensation
Medical, dental, vision coverage
Lunch and dinner in office
+5
Frontier Agent Post-Training: Artifacts Engineer
Frontier Agent Post-Training: Artifacts Engineer

OpenAI • San Francisco (CA)

On-site
USD 380,000 - 500,000
Agent Post-Training Researcher
Agent Post-Training Researcher

OpenAI • San Francisco (CA)

On-site
USD 180,000 - 240,000
Frontier AI Safety Researcher (Hybrid — SF)
Frontier AI Safety Researcher (Hybrid — SF)

AI Chopping Block • San Francisco (CA), Northern (KY)

Hybrid
USD 180,000 - 240,000
Hybrid work model
Relocation assistance