Remote Reinforcement Learning Research Engineer

Visa Hunt

United States

Remote

USD 140,000 - 180,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Remote-first company
Equity compensation
Performance-based bonuses

Job summary

micro1 seeks a Member of Technical Staff, Research Engineering to push the frontier of reinforcement learning. You will design self-contained RL environments, build scalable training pipelines, and create evaluation systems that drive high-performance AI models in a remote-first setup.

You will collaborate across research and production, translating ideas into reproducible experiments and contributing to benchmarks and releases on internal platforms.

Qualifications

  • Deep experience in reinforcement learning, including environment design and training dynamics.
  • Proven ability to build and scale RL systems, pipelines, or experimentation frameworks.
  • Experience with synthetic data pipelines and automated evaluation workflows.
  • Strong communication and technical writing skills in a fast-paced research setting.

Responsibilities

  • Architect self-contained RL environments with rewards, verifiers, and evaluation logic.
  • Design and scale episode pipelines and training processes to support reproducible experiments.
  • Build automated data generation systems using synthetic data for faster iterations.
  • Develop AI-driven evaluation and QA systems for automated grading and feedback.
  • Fine-tune open-source RL models using internal datasets and custom training strategies.
  • Establish benchmarking frameworks to measure model capability and data quality.
  • Contribute to releases and analyses of evaluations on internal benchmark platforms.

Skills

Reinforcement Learning
RL Environment Design
RL System Scaling
Automation & Data Generation
Automated Evaluation Systems
Open-Source ML Tuning
Technical Writing

Job description

micro1 seeks a Member of Technical Staff, Research Engineering to push the frontier of reinforcement learning. You will design self-contained RL environments, build scalable training pipelines, and create evaluation systems that drive high-performance AI models in a remote-first setup.

You will collaborate across research and production, translating ideas into reproducible experiments and contributing to benchmarks and releases on internal platforms.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Remote Reinforcement Learning Engineer — Production-Ready
Remote Reinforcement Learning Engineer — Production-Ready

Bright Vision Technologies • Richardson (TX)

On-site
USD 100,000 - 150,000
Senior Reinforcement Learning Engineer (Remote)
Senior Reinforcement Learning Engineer (Remote)

Bright Vision Technologies • Flower Mound (TX)

On-site
USD 155,000 - 180,000
Equal Opportunity Employer
Research Engineer: Scalable RL Environments & Production
Research Engineer: Scalable RL Environments & Production

somewhere • Mountain View (CA)

On-site
USD 120,000 - 160,000
Health coverage
Ownership upside
Collaboration with leading AI research organizations
Remote Reinforcement Learning Systems Engineer
Remote Reinforcement Learning Systems Engineer

United States Digital Space LLC • United States

Remote
USD 100,000 - 150,000
Remote Reinforcement Learning Engineer — Scale & Deploy
Remote Reinforcement Learning Engineer — Scale & Deploy

Bright Vision Technologies • Reston (VA)

On-site
USD 100,000 - 150,000
Remote RL Engineer - Scale RL in Production
Remote RL Engineer - Scale RL in Production

Bright Vision Technologies • Novi (MI)

Remote
USD 96,000 - 120,000
Senior Reinforcement Learning Engineer - Remote
Senior Reinforcement Learning Engineer - Remote

United States Digital Space LLC • United States

Remote
USD 100,000 - 150,000
Member of Technical Staff - Reinforcement Learning
Member of Technical Staff - Reinforcement Learning

Optimized, Inc. • San Francisco (CA)

On-site
USD 185,000 - 255,000
Remote Reinforcement Learning Systems Engineer
Remote Reinforcement Learning Systems Engineer

Bright Vision Technologies • Bellevue (WA)

On-site
USD 100,000 - 150,000
Remote Senior RL Scientist — Agent Design & Training
Remote Senior RL Scientist — Agent Design & Training

Centific Global Solutions, Inc. • United States

On-site
USD 200,000 - 250,000