Research Engineer — RL Evaluation & Benchmarks

Invisible Technologies Inc.

New York (NY)

Hybrid

USD 150,000 - 210,000

Full time

14 days+
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Benefits offered by this job

Bonuses and equity
Hybrid work environment

Job summary

Invisible Technologies is building a reinforcement learning capability within its research group. As a Research Engineer, you will design how frontier models are measured, create scoring frameworks, build evaluation architectures, and ship production systems that realize your designs.

Depending on level, you’ll report to the Lead Research Engineer or directly to the VP of Research. This role emphasizes owning methodology and delivering end-to-end solutions.

Qualifications

  • Production-quality code written daily; this is a hard requirement.
  • Fluency in Python and comfort across the modern ML stack.
  • Real experience building evaluation systems, RL environments, or training/inference infra.
  • Hands-on with modern agentic flows.
  • Familiarity with RL methods and frontier model evaluation; weight on this over years.
  • Track record turning ambiguous questions into working systems and shipping results.

Responsibilities

  • Design benchmarks and RL environments that measure real model capability.
  • Originate evaluation methodology and translate into scoring frameworks and architectures.
  • Write and ship production code implementing your designs.
  • Build and maintain data pipelines that feed evaluation runs.
  • Run analysis to establish result reproducibility and validity.
  • Collaborate with Research Scientists, Solutions Architects, and ML engineers.

Skills

Production-quality code
Python & ML stack
Evaluation systems
Agentic systems
Reinforcement learning
Research to production

Tools

Python
ML frameworks
Data pipelines

Job description

Invisible Technologies is building a reinforcement learning capability within its research group. As a Research Engineer, you will design how frontier models are measured, create scoring frameworks, build evaluation architectures, and ship production systems that realize your designs.

Depending on level, you’ll report to the Lead Research Engineer or directly to the VP of Research. This role emphasizes owning methodology and delivering end-to-end solutions.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

RL Evaluation Engineer: Build Production Benchmarks
RL Evaluation Engineer: Build Production Benchmarks

Invisible, Inc. • Northern (KY), New York (NY)

Hybrid
USD 150,000 - 210,000
Bonuses
Equity
Benchmarking Research Engineer: Frontier Model Evaluations
Benchmarking Research Engineer: Frontier Model Evaluations

Refresh AI • San Francisco (CA)

On-site
USD 120,000 - 150,000
Research Engineer, RL Environments
Research Engineer, RL Environments

Mecka • New York (NY), Northern (KY)

Hybrid
USD 110,000 - 170,000
Remote AI Research Engineer - RL & Model Evaluation
Remote AI Research Engineer - RL & Model Evaluation

Appen Limited • United States

Remote
USD 120,000 - 180,000
Research Engineer - Post-Training & Data Environments
Research Engineer - Post-Training & Data Environments

Mercor • San Francisco (CA)

On-site
USD 150,000 - 210,000
Generous equity grant
$10K housing bonus
$1.5K monthly food stipend
+2
Staff Research Engineer - Frontier AI & RL Evaluation
Staff Research Engineer - Frontier AI & RL Evaluation

Crossing Hurdles • United States

Remote
USD 150,000 - 210,000
Senior Research Engineer — Frontier AI & RL Systems
Senior Research Engineer — Frontier AI & RL Systems

Turing Enterprises, Inc. • San Francisco (CA)

On-site
USD 250,000 - 350,000
Research Engineer - RL & Formal Methods Innovator
Research Engineer - RL & Formal Methods Innovator

Harmonic • Palo Alto (CA)

On-site
USD 100,000 - 130,000
Unlimited PTO
401(k) matching
100% employer-paid health, vision, and dental benefits
+1
Remote AI Research Engineer — RL & LLM Systems
Remote AI Research Engineer — RL & LLM Systems

Not specified • United States

Remote
USD 120,000 - 180,000
Research Engineer, RL & LLM Post-Training — Scale ML Infra
Research Engineer, RL & LLM Post-Training — Scale ML Infra

Preference Model • San Francisco (CA)

On-site
USD 180,000 - 240,000
Competitive cash and equity (>90th pct
Ownership and autonomy
Lunch onsite
+4