Senior Multimodal Policy Engineer (Post-Training)

Walden Robotics

Cambridge (MA)

On-site

USD 250,000 - 400,000

Full time

14 days+
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Benefits offered by this job

Salary + bonus
Equity
401(k) with company match
Flexible PTO
Daily lunch

Job summary

Walden Robotics seeks a senior technical leader to guide how foundation models become capable, aligned robot policies. You will drive SFT, RLHF/DPO-style fine-tuning, distillation, and RL to deploy reliable policies on real robots across tasks and embodiments.

Working with AI leadership, you will shape post-training strategies, push multimodal reasoning, and ensure robust evaluation. You will mentor the team and collaborate with data groups to improve behavior and safety in real-world settings.

Qualifications

  • Post-training large multimodal models (SFT, RLHF/DPO-style) experience.
  • Strong RL for large models and policy optimization.
  • Experience with multimodal LLMs or VLA at frontier scale.
  • A track record of end-to-end model-improvement programs.
  • Judgment on what to measure and where to debug.

Responsibilities

  • Shape post-training recipe and own key stages to deploy policies.
  • Push grounded reasoning, tool use, and multimodal understanding.
  • Align model behavior with product and safety requirements.
  • Strengthen eval/experimentation spanning offline and on-robot performance.
  • Set technical bar, mentor team, and partner with data teams.

Skills

Post-Training Depth
Reinforcement Learning
Frontier-Scale Models
Program Ownership
Measurement & Grounding

Job description

Walden Robotics seeks a senior technical leader to guide how foundation models become capable, aligned robot policies. You will drive SFT, RLHF/DPO-style fine-tuning, distillation, and RL to deploy reliable policies on real robots across tasks and embodiments.

Working with AI leadership, you will shape post-training strategies, push multimodal reasoning, and ensure robust evaluation. You will mentor the team and collaborate with data groups to improve behavior and safety in real-world settings.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Senior Member of Technical Staff: Multimodal Post-Training
Senior Member of Technical Staff: Multimodal Post-Training

Walden Robotics • Cambridge (MA)

On-site
USD 250,000 - 400,000
Salary + bonus
Equity
401(k) with company match
+2
Member of Technical Staff: Policy Pretraining
Member of Technical Staff: Policy Pretraining

Walden Robotics, Inc. • San Francisco (CA)

On-site
USD 180,000 - 240,000
Senior Architect, Multimodal Pre-Training
Senior Architect, Multimodal Pre-Training

Walden Robotics • Cambridge (MA)

On-site
USD 230,000 - 460,000
Salary
Annual cash bonus
Company equity
+5
Senior RL & Controls Engineer, Humanoid Robotics
Senior RL & Controls Engineer, Humanoid Robotics

Walden Robotics • Cambridge (MA)

On-site
USD 140,000 - 210,000
Salary
Annual cash bonus
Company equity
+5
Robotics RL & Control Engineer – Whole-Body Locomotion
Robotics RL & Control Engineer – Whole-Body Locomotion

Walden Robotics, Inc. • Cambridge (MA)

On-site
USD 140,000 - 190,000
Cash bonus
Equity
Company-subsidized insurance programs
+3
Senior Member of Technical Staff: Reinforcement Learning for Wholebody Control
Senior Member of Technical Staff: Reinforcement Learning for Wholebody Control

Walden Robotics • Cambridge (MA)

On-site
USD 140,000 - 210,000
Salary
Annual cash bonus
Company equity
+5
Senior Member of Technical Staff: Multimodal Pre-Training
Senior Member of Technical Staff: Multimodal Pre-Training

Walden Robotics • Cambridge (MA)

On-site
USD 230,000 - 460,000
Salary
Annual cash bonus
Company equity
+5
Founding Robot Learning Engineer: Policy Training & Eval
Founding Robot Learning Engineer: Policy Training & Eval

One Robot (YC W26) • San Francisco (CA)

On-site
USD 150,000 - 275,000
Senior Robot Learning Scientist & Engineer — Real-World Policy
Senior Robot Learning Scientist & Engineer — Real-World Policy

Holiday Robotics Inc. • Mountain View (CA)

Hybrid
USD 200,000 - 300,000
Employer-paid health insurance
Relocation stipend
Free daily meals
+1
Founding Robot Learning Engineer — Policy Training & Eval
Founding Robot Learning Engineer — Policy Training & Eval

One Robot • San Francisco (CA)

On-site
USD 180,000 - 240,000