Frontier AI Evaluation Scientist

Neura Market

San Francisco (CA)

On-site

USD 200,000 - 250,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

OpenAI is seeking a researcher to advance frontier evaluations and environments for safe AGI/ASI. You will help design north star model environments and steer major training runs so that research outputs translate into real-world products.

Collaborate with researchers, engineers, product and safety teams to decide what to measure, how to measure it, and how to ship improvements. This high-autonomy role rewards curiosity and clear communication.

Qualifications

  • Strong technical fundamentals in machine learning, software engineering, systems, statistics, or a related field.
  • Hands-on experience with LLMs, RL, RLHF/RLAIF, post-training, evals, graders, synthetic data, model training, coding agents, tool-using agents, or production ML systems.
  • Interested in open-ended problems requiring research taste and engineering execution.

Responsibilities

  • Create ambitious RL environments to push frontier model capabilities and measure behaviors.
  • Develop new methodologies for automatically exploring model behavior.
  • Dive into measurement science, including scalability, reliability, and variance of evaluation.
  • Help steer training for the largest runs and translate insights into improvements.
  • Design scalable systems to support continuous evaluation.
  • Build self-improvement loops to automate model understanding.

Skills

ML fundamentals
Software engineering
RL & evaluation

Job description

OpenAI is seeking a researcher to advance frontier evaluations and environments for safe AGI/ASI. You will help design north star model environments and steer major training runs so that research outputs translate into real-world products.

Collaborate with researchers, engineers, product and safety teams to decide what to measure, how to measure it, and how to ship improvements. This high-autonomy role rewards curiosity and clear communication.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Frontier AI Evaluation Architect
Frontier AI Evaluation Architect

United States Digital Space LLC • San Francisco (CA)

On-site
USD 120,000 - 160,000
Frontier AI Evaluation Engineer: RL Environments
Frontier AI Evaluation Engineer: RL Environments

OpenAI • San Francisco (CA)

On-site
USD 120,000 - 160,000
Frontier AI Safety Researcher
Frontier AI Safety Researcher

Triwill Group • San Francisco (CA)

On-site
USD 180,000 - 320,000
Frontier AI Safety Evaluator
Frontier AI Safety Evaluator

Dorado • United States

Remote
USD 110,000 - 170,000
Frontier AI Risk Evaluations Scientist
Frontier AI Risk Evaluations Scientist

Scale AI, Inc. • New York (NY)

On-site
USD 216,000 - 270,000
Comprehensive health, dental and vision coverage
Retirement benefits
Learning and development stipend
+2
Research Engineer, Frontier Evals & Environments
Research Engineer, Frontier Evals & Environments

OpenAI • San Francisco (CA)

On-site
USD 120,000 - 160,000
Research Engineer, Frontier Evals & Environments
Research Engineer, Frontier Evals & Environments

OpenAI • Los Angeles (CA)

On-site
USD 100,000 - 150,000
Senior Frontier AI Safety Evaluator
Senior Frontier AI Safety Evaluator

Obsidian • San Francisco (CA)

Remote
USD 120,000 - 180,000
Frontier AI Safety Evaluator & Policy Expert
Frontier AI Safety Evaluator & Policy Expert

Obsidian • San Francisco (CA)

On-site
USD 140,000 - 210,000
Frontier AI Safety Evaluator & Policy Auditor
Frontier AI Safety Evaluator & Policy Auditor

Obsidian • New York (NY)

On-site
USD 120,000 - 180,000