Founding ML Evaluation Layer for Robotic Policy Validation

One Robot

San Francisco (CA)

On-site

USD 140,000 - 210,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

One Robot builds task-specific world models and an evaluation platform for robot manipulation policies. We train end-to-end policies and iterate rapidly, validating where policies fail and what data to collect to fix them.

Our team focuses on robust evaluation, VLM/LLM training, and data-driven improvements, working with real customer data and deployments. Based in San Francisco, we value ownership and fast iteration.

Qualifications

  • Strong coding in Python and PyTorch.
  • Track record in training VLMs or LLMs.
  • Developed and shipped evals for VLMs or LLMs.

Responsibilities

  • Train evaluation models to classify and verify policy behavior.
  • Build confidence layers that translate model outputs into trustworthy signals for customers.
  • Improve model grounding to reason about physical and spatial scenes.
  • Build a self-improving evaluation layer to sharpen eval models with deployments and corrections.

Skills

Python
PyTorch
VLM training
LLM training
Eval development

Tools

Python tooling

Job description

One Robot builds task-specific world models and an evaluation platform for robot manipulation policies. We train end-to-end policies and iterate rapidly, validating where policies fail and what data to collect to fix them.

Our team focuses on robust evaluation, VLM/LLM training, and data-driven improvements, working with real customer data and deployments. Based in San Francisco, we value ownership and fast iteration.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Founding Machine Learning - Eval Layer
Founding Machine Learning - Eval Layer

One Robot • San Francisco (CA)

On-site
USD 140,000 - 210,000
Founding Robot Learning Engineer — Policy Training & Eval
Founding Robot Learning Engineer — Policy Training & Eval

One Robot • San Francisco (CA)

On-site
USD 180,000 - 240,000
Founding Robot Learning
Founding Robot Learning

One Robot • San Francisco (CA)

On-site
USD 180,000 - 240,000
Robotics Policy Evaluation Engineer
Robotics Policy Evaluation Engineer

Walden Robotics • San Francisco (CA)

On-site
USD 140,000 - 190,000
Robotics Foundation Model Engineer
Robotics Foundation Model Engineer

Lightwheel • California (MO)

On-site
USD 140,000 - 200,000
Senior Multimodal Policy Engineer (Post-Training)
Senior Multimodal Policy Engineer (Post-Training)

Walden Robotics • Cambridge (MA)

On-site
USD 250,000 - 400,000
Salary + bonus
Equity
401(k) with company match
+2
Robotics Engineer/Researcher - Robot Learning - Imitation Learning, Foundation Models, RL
Robotics Engineer/Researcher - Robot Learning - Imitation Learning, Foundation Models, RL

Proception Inc. • Palo Alto (CA)

On-site
USD 140,000 - 210,000
Full-Stack Robotics Engineer (Forward Deployed)
Full-Stack Robotics Engineer (Forward Deployed)

Synphony (YC P26) • San Francisco (CA)

On-site
USD 150,000 - 210,000
Robot Learning Engineer: Scalable Multimodal Policies
Robot Learning Engineer: Scalable Multimodal Policies

Proception Inc. • Palo Alto (CA)

On-site
USD 140,000 - 210,000
Robot Learning Engineer — Sim-to-Real Policies
Robot Learning Engineer — Sim-to-Real Policies

World Labs Inc. • San Francisco (CA)

On-site
USD 250,000 - 350,000