Senior Multimodal Policy Engineer (Post-Training)

Walden Robotics

Cambridge (MA)

On-site

USD 250,000 - 400,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Salary + bonus
Equity
401(k) with company match
Flexible PTO
Daily lunch

Job summary

Walden Robotics seeks a senior technical leader to guide how foundation models become capable, aligned robot policies. You will drive SFT, RLHF/DPO-style fine-tuning, distillation, and RL to deploy reliable policies on real robots across tasks and embodiments.

Working with AI leadership, you will shape post-training strategies, push multimodal reasoning, and ensure robust evaluation. You will mentor the team and collaborate with data groups to improve behavior and safety in real-world settings.

Qualifications

  • Post-training large multimodal models (SFT, RLHF/DPO-style) experience.
  • Strong RL for large models and policy optimization.
  • Experience with multimodal LLMs or VLA at frontier scale.
  • A track record of end-to-end model-improvement programs.
  • Judgment on what to measure and where to debug.

Responsibilities

  • Shape post-training recipe and own key stages to deploy policies.
  • Push grounded reasoning, tool use, and multimodal understanding.
  • Align model behavior with product and safety requirements.
  • Strengthen eval/experimentation spanning offline and on-robot performance.
  • Set technical bar, mentor team, and partner with data teams.

Skills

Post-Training Depth
Reinforcement Learning
Frontier-Scale Models
Program Ownership
Measurement & Grounding

Job description

Walden Robotics seeks a senior technical leader to guide how foundation models become capable, aligned robot policies. You will drive SFT, RLHF/DPO-style fine-tuning, distillation, and RL to deploy reliable policies on real robots across tasks and embodiments.

Working with AI leadership, you will shape post-training strategies, push multimodal reasoning, and ensure robust evaluation. You will mentor the team and collaborate with data groups to improve behavior and safety in real-world settings.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Member of Technical Staff: Multimodal Post-Training
Senior Member of Technical Staff: Multimodal Post-Training

Walden Robotics • Cambridge (MA)

On-site
USD 250,000 - 400,000
Salary + bonus
Equity
401(k) with company match
+2
Senior Architect, Multimodal Pre-Training
Senior Architect, Multimodal Pre-Training

Walden Robotics • Cambridge (MA)

On-site
USD 230,000 - 460,000
Salary
Annual cash bonus
Company equity
+5
Staff Engineer, Robotics: RL & Whole-Body Control
Staff Engineer, Robotics: RL & Whole-Body Control

Walden Robotics • Cambridge (MA)

On-site
USD 90,000 - 130,000
Annual cash bonus
Company equity
Insurance programs
+3
Senior RL & Controls Engineer, Humanoid Robotics
Senior RL & Controls Engineer, Humanoid Robotics

Walden Robotics • Cambridge (MA)

On-site
USD 140,000 - 210,000
Salary
Annual cash bonus
Company equity
+5
Member of Technical Staff: Policy Evaluation & Experiment Infrastructure
Member of Technical Staff: Policy Evaluation & Experiment Infrastructure

Walden Robotics • San Francisco (CA)

On-site
USD 140,000 - 190,000
Robotics RL & Control Engineer – Whole-Body Locomotion
Robotics RL & Control Engineer – Whole-Body Locomotion

Walden Robotics, Inc. • Cambridge (MA)

On-site
USD 140,000 - 190,000
Cash bonus
Equity
Company-subsidized insurance programs
+3
Member of Technical Staff – Engineer, RL and Control
Member of Technical Staff – Engineer, RL and Control

Walden Robotics, Inc. • Cambridge (MA)

On-site
USD 140,000 - 190,000
Cash bonus
Equity
Company-subsidized insurance programs
+3
Senior Member of Technical Staff: Multimodal Pre-Training
Senior Member of Technical Staff: Multimodal Pre-Training

Walden Robotics • Cambridge (MA)

On-site
USD 230,000 - 460,000
Salary
Annual cash bonus
Company equity
+5
Senior Member of Technical Staff: Reinforcement Learning for Policy Post-Training
Senior Member of Technical Staff: Reinforcement Learning for Policy Post-Training

Walden Robotics • San Francisco (CA)

On-site
USD 140,000 - 190,000
Robotics Policy Evaluation Engineer
Robotics Policy Evaluation Engineer

Walden Robotics • San Francisco (CA)

On-site
USD 140,000 - 190,000