Founding ML Engineer - Robotic Policy Evaluation

One Robot (YC W26)

San Francisco (CA)

On-site

USD 150,000 - 275,000

Full time

33 hours ago
Be an early applicant
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Job summary

One Robot in San Francisco is hiring a researcher/engineer to advance its evaluation platform for robot manipulation policies. You will focus on training evaluation models, validating policy behavior on real deployments, and building scalable evaluation layers.

You will work with real customer data and drive improvements from data collection to production feedback, shaping how the eval system predicts and explains policy failures across long-horizon tasks.

Qualifications

  • Strong Python and PyTorch coding skills.
  • Experience training VLMs or LLMs.
  • Experience developing and shipping evals for VLMs/LLMs.

Responsibilities

  • Train evaluation models to classify and verify policy behavior.
  • Build confidence layers translating outputs into actionable signals.
  • Improve grounding of models for physical and spatial scenes.
  • Develop data engine to sharpen eval models with deployments.

Skills

Python
PyTorch
VLM training
LLM training
Eval development

Job description

One Robot in San Francisco is hiring a researcher/engineer to advance its evaluation platform for robot manipulation policies. You will focus on training evaluation models, validating policy behavior on real deployments, and building scalable evaluation layers.

You will work with real customer data and drive improvements from data collection to production feedback, shaping how the eval system predicts and explains policy failures across long-horizon tasks.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Founding Robot Learning Engineer — Policy Training & Eval
Founding Robot Learning Engineer — Policy Training & Eval

One Robot • San Francisco (CA)

On-site
USD 180,000 - 240,000
Founding Robot Learning Engineer: Policy Training & Eval
Founding Robot Learning Engineer: Policy Training & Eval

One Robot (YC W26) • San Francisco (CA)

On-site
USD 150,000 - 275,000
Founding Robot Learning
Founding Robot Learning

One Robot (YC W26) • San Francisco (CA)

On-site
USD 150,000 - 275,000
Founding ML Evaluation Layer for Robotic Policy Validation
Founding ML Evaluation Layer for Robotic Policy Validation

One Robot • San Francisco (CA)

On-site
USD 140,000 - 210,000
Founding Robot Learning
Founding Robot Learning

One Robot • San Francisco (CA)

On-site
USD 180,000 - 240,000
Robotics ML Research Intern: Real-World Policy & Evaluation
Robotics ML Research Intern: Real-World Policy & Evaluation

One Robot (YC W26) • San Francisco (CA)

On-site
USD 25,000 - 39,000
Robotics ML Research Scientist (Fine-Tuning & RL)
Robotics ML Research Scientist (Fine-Tuning & RL)

Generalist • San Francisco (CA)

On-site
USD 120,000 - 160,000
Machine Learning Intern
Machine Learning Intern

One Robot (YC W26) • San Francisco (CA)

On-site
USD 25,000 - 39,000
Senior ML Engineer - Robotics Manipulation & Production
Senior ML Engineer - Robotics Manipulation & Production

The Robot Age • San Francisco (CA), Northern (KY)

Hybrid
USD 180,000 - 240,000
Robot Learning Engineer: Scalable Multimodal Policies
Robot Learning Engineer: Scalable Multimodal Policies

Proception Inc. • Palo Alto (CA)

On-site
USD 140,000 - 210,000