Applied AI Research Engineer - RL Environments & Evaluation

HeyMilo AI

San Francisco (CA)

On-site

USD 150,000 - 210,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

HeyMilo AI is hiring a Research Engineer to join our Applied AI team in San Francisco. You’ll design and build reinforcement learning environments with verifiable rewards for real-world use cases, creating simulators, reward functions, and evaluation harnesses to measure model performance.

The role blends ML research with systems engineering, collaborating directly with founders and advisors to take a use case from problem definition to reproducible environments for training and evaluation.

Qualifications

  • Master's degree or PhD in AI, ML, CS or related field.
  • Solid grounding in reinforcement learning and LLM post-training (reward design, policy optimization, evaluation).
  • Strong software engineering skills in Python and reproducible code.

Responsibilities

  • Design and build RL environments for real-world use cases, including simulators and reward functions.
  • Create verifiable evaluation harnesses with clean scoring and cost tracking.
  • Run post-training experiments to validate learnable signals from environments.
  • Package environments and results for reproducibility and publish evaluations.
  • Contribute to research write-ups and determine next-use cases.

Skills

Reinforcement learning
LLM evaluation
Python
Experiment design
Research collaboration

Education

Master's degree or PhD in AI/ML/CS

Tools

Docker
Linux
Cloud environments

Job description

HeyMilo AI is hiring a Research Engineer to join our Applied AI team in San Francisco. You’ll design and build reinforcement learning environments with verifiable rewards for real-world use cases, creating simulators, reward functions, and evaluation harnesses to measure model performance.

The role blends ML research with systems engineering, collaborating directly with founders and advisors to take a use case from problem definition to reproducible environments for training and evaluation.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Research Engineer, Applied AI
Research Engineer, Applied AI

HeyMilo AI • San Francisco (CA)

On-site
USD 150,000 - 210,000
AI Systems Engineer — RL Environments & Scalable Infra
AI Systems Engineer — RL Environments & Scalable Infra

AI Talent Now • San Francisco (CA)

On-site
USD 120,000 - 150,000
RL Environment Engineer: Shape Frontier AI
RL Environment Engineer: Shape Frontier AI

AI Talent Now • San Francisco (CA)

On-site
USD 150,000 - 250,000
Research Engineer: Scalable RL Environments & Production
Research Engineer: Scalable RL Environments & Production

somewhere • Mountain View (CA)

On-site
USD 120,000 - 160,000
Health coverage
Ownership upside
Collaboration with leading AI research organizations
Research Engineer
Research Engineer

Barrington James • San Francisco (CA)

On-site
USD 140,000 - 210,000
Junior AI RL Environment Engineer — SF
Junior AI RL Environment Engineer — SF

Simplify • San Francisco (CA)

On-site
USD 255,000 - 345,000
RL Environment Software Engineer
RL Environment Software Engineer

talentpluto • San Francisco (CA)

Hybrid
USD 180,000 - 220,000
Researcher, Synthetic RL
Researcher, Synthetic RL

OpenAI • Los Angeles (CA)

Hybrid
USD 120,000 - 160,000
Research Engineer, Reinforcement Learning
Research Engineer, Reinforcement Learning

Techire Ai • San Francisco (CA)

On-site
USD 250,000 - 300,000
ML Systems Engineer — RL Training & Finetuning
ML Systems Engineer — RL Training & Finetuning

Anthropic • San Francisco (CA)

Hybrid
USD 500,000 - 850,000
Competitive compensation
Equity donation matching
Generous vacation and parental leave
+1