RL Scientist — Industrial Foundation Models

Sigma Nova

Paris

On-site

EUR 75,000 - 110,000

Full time

14 days+
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Job summary

Sigma Nova is seeking a Research Scientist (Reinforcement Learning) to bring RL into the core of how foundation models are adapted for industrial use. You’ll design learning signals from expert feedback and build robust evaluation protocols.

You’ll work with engineers to deploy RL methods on production-ready models, address safety and uncertainty, and publish open research artifacts as appropriate.

Qualifications

  • PhD or equivalent research experience in Reinforcement Learning / Machine Learning.
  • Strong foundations in RL: policy optimization, off-policy learning, exploration, credit assignment.
  • Ability to design rigorous experiments, debug failure modes, and iterate with scientific discipline.

Responsibilities

  • Turn expert validation/correction into reliable learning signals for RL.
  • Design practical feedback interfaces and signals for real operational settings.
  • Develop RL methods that sit on top of foundation models used in production.
  • Build evaluation protocols addressing robustness, uncertainty, safety, auditability and cost of error.
  • Collaborate with scientists/engineers to ship demonstrators linking benchmarks to field outcomes.

Skills

Reinforcement Learning
Python
PyTorch
Experiment design
Debugging

Education

PhD or equivalent research experience in RL/ML

Tools

Python
PyTorch

Job description

Sigma Nova is seeking a Research Scientist (Reinforcement Learning) to bring RL into the core of how foundation models are adapted for industrial use. You’ll design learning signals from expert feedback and build robust evaluation protocols.

You’ll work with engineers to deploy RL methods on production-ready models, address safety and uncertainty, and publish open research artifacts as appropriate.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Research Scientist — Reinforcement Learning (Foundation Models)
Research Scientist — Reinforcement Learning (Foundation Models)

Sigma Nova • Paris

On-site
EUR 75,000 - 110,000
Founding RL Research Engineer — Hybrid EU, Equity
Founding RL Research Engineer — Hybrid EU, Equity

Built Different • Paris

Hybrid
EUR 119,000 - 161,000
Founding equity
Hybrid work model
AI Research Scientist
AI Research Scientist

Meta • Paris

On-site
EUR 120,000 - 180,000
Research Engineer
Research Engineer

Built Different • Paris

Hybrid
EUR 119,000 - 161,000
Founding equity
Hybrid work model
Research Internship : Reliable and Adaptive Machine Learning
Research Internship : Reliable and Adaptive Machine Learning

Sigma Nova • Paris

On-site
EUR 8,900 - 13,000
Research Engineer, Multimodal Brain Signal AI
Research Engineer, Multimodal Brain Signal AI

Sigma Nova • Paris

Hybrid
EUR 70,000 - 120,000
Senior ML Robotics Scientist – Foundation Models
Senior ML Robotics Scientist – Foundation Models

NAVER LABS Europe • Meylan

On-site
EUR 60,000 - 90,000
Flexible work/life balance
Collaborative environment
Research Engineer
Research Engineer

Sigma Nova • Paris

Hybrid
EUR 70,000 - 120,000
Research Intern: Bayesian ML & Federated Learning
Research Intern: Bayesian ML & Federated Learning

Sigma Nova • Paris

On-site
EUR 8,900 - 13,000
AI Research Engineer: Scalable ML Systems & RL
AI Research Engineer: Scalable ML Systems & RL

Datadog, Inc. • Paris

On-site
EUR 90,000 - 130,000
Competitive benefits
RSUs + ESPP
Cross-office collaboration
+1