Frontier AI Behavior Research Scientist

Transluce

San Francisco, Northern (CA, KY)

Hybrid

USD 250,000 - 450,000

Full time

14 days+
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

Transluce, a fast-moving nonprofit research lab in San Francisco, seeks an AI Behavior Researcher to lead automated evaluations of frontier AI systems, focusing on honesty and alignment. You will design novel evaluations, write analysis code, and collaborate with governance to drive impactful public-policy work.

You will build environment simulators and LLM-based judge pipelines, contributing to scalable, rigorous research while growing with a highly collaborative team and, when needed, visa

Qualifications

  • Expertise in quantitative AI evaluation and measurement.
  • Experience designing automated AI evaluation methods, such as LLM-as-a-judge systems or multi-turn benchmarks.
  • Proficiency in Python to implement analysis and evaluation tooling.
  • Meticulous, good experimental design, epistemic self-awareness and transparency.
  • Ability to iterate quickly and balance between scrappiness and thoroughness based on impact needs.

Responsibilities

  • Develop novel, valid automated evaluations of AI agents' honesty and alignment.
  • Write code to implement and run automated evaluations, such as environment simulators or LLM-as-a-judge pipelines.
  • Design methods to improve the ecological of automated evaluations, and measure effects as models become more capable.
  • Collaborate with governance to deliver high-impact evaluations for public policy.
  • Collaborate with scientists and research engineers to productionize best practices in AI behavior evaluation.

Skills

AI evaluation
Python
Experimental design
Communication
Epistemic transparency

Tools

LLM-as-a-judge pipelines
Environment simulators

Job description

Transluce, a fast-moving nonprofit research lab in San Francisco, seeks an AI Behavior Researcher to lead automated evaluations of frontier AI systems, focusing on honesty and alignment. You will design novel evaluations, write analysis code, and collaborate with governance to drive impactful public-policy work.

You will build environment simulators and LLM-based judge pipelines, contributing to scalable, rigorous research while growing with a highly collaborative team and, when needed, visa

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

AI Behavior Researcher - Agent Alignment
AI Behavior Researcher - Agent Alignment

Socket.dev • San Francisco (CA)

On-site
USD 250,000 - 450,000
AI Behavior Researcher - Agent Alignment
AI Behavior Researcher - Agent Alignment

Transluce • San Francisco (CA), Northern (KY)

Hybrid
USD 250,000 - 450,000
AI Behavior Engineer
AI Behavior Engineer

Transluce • San Francisco (CA)

On-site
USD 310,000 - 500,000
Forward‑Deployed AI Behavior Engineer
Forward‑Deployed AI Behavior Engineer

Transluce • San Francisco (CA)

On-site
USD 310,000 - 500,000
AI Behavior Researcher: Safeguarding Kids & Mental Health
AI Behavior Researcher: Safeguarding Kids & Mental Health

Transluce • San Francisco (CA)

On-site
USD 250,000 - 450,000
AI Behavior Researcher - Child Safety and Mental Health
AI Behavior Researcher - Child Safety and Mental Health

Transluce • San Francisco (CA)

On-site
USD 250,000 - 450,000
Research Scientist/Research Engineer
Research Scientist/Research Engineer

Transluce • San Francisco (CA)

On-site
USD 250,000 - 500,000
Research Scientist, AI Systems & RL for Public Good
Research Scientist, AI Systems & RL for Public Good

Transluce • San Francisco (CA)

On-site
USD 250,000 - 500,000
Frontier AI Safety Evaluator & Policy Auditor
Frontier AI Safety Evaluator & Policy Auditor

Obsidian • New York (NY)

On-site
USD 120,000 - 180,000
Frontier AI Safety Researcher (Hybrid — SF)
Frontier AI Safety Researcher (Hybrid — SF)

AI Chopping Block • San Francisco (CA), Northern (KY)

Hybrid
USD 180,000 - 240,000
Hybrid work model
Relocation assistance