ML Research Engineer: Fine-Tuning & Evaluation Systems

HonestAI

San Francisco (CA)

On-site

USD 140,000 - 190,000

Full time

14 days+
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Job summary

HonestAI in San Francisco is seeking a researcher to join a small team focused on fine-tuning, retrieval, and agent evaluation. You will bridge papers to production and run controlled experiments on agent quality and cost.

You will build evaluation harnesses and offline benchmarks, publish internal notes that inform product decisions, and collaborate with ML researchers and engineers to advance model performance and reliability.

Qualifications

  • MS/PhD in CS/ML or related, or equivalent experience.
  • Proven track record shipping evaluation or fine-tuning systems.
  • Fluent in PyTorch.

Responsibilities

  • Run controlled experiments on agent quality and cost.
  • Build evaluation harnesses and offline benchmarks.
  • Publish internal research notes that drive product decisions.

Skills

PyTorch
Evaluation

Education

MS / PhD in CS / ML or related

Job description

HonestAI in San Francisco is seeking a researcher to join a small team focused on fine-tuning, retrieval, and agent evaluation. You will bridge papers to production and run controlled experiments on agent quality and cost.

You will build evaluation harnesses and offline benchmarks, publish internal notes that inform product decisions, and collaborate with ML researchers and engineers to advance model performance and reliability.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

ML Research Engineer
ML Research Engineer

HonestAI • San Francisco (CA)

On-site
USD 140,000 - 190,000
ML Systems Engineer — RL Training & Finetuning
ML Systems Engineer — RL Training & Finetuning

Anthropic • San Francisco (CA)

Hybrid
USD 500,000 - 850,000
Competitive compensation
Equity donation matching
Generous vacation and parental leave
+1
Enterprise ML Systems Research Engineer - GenAI & Agent
Enterprise ML Systems Research Engineer - GenAI & Agent

Scale AI • San Francisco (CA)

On-site
USD 265,000 - 331,000
Health, dental and vision coverage
Equity compensation
Learning and development stipend
+2
AI Evaluation Researcher: Post-Training Signals & Metrics
AI Evaluation Researcher: Post-Training Signals & Metrics

Mosaic.tech • San Francisco (CA)

On-site
USD 140,000 - 190,000
ML Evaluation Engineer: Benchmark & Model Quality
ML Evaluation Engineer: Benchmark & Model Quality

Reducto • San Francisco (CA)

On-site
USD 100,000 - 130,000
Unlimited PTO
Daily free lunch
Reimbursed transportation
+3
Robotics ML Research Scientist (Fine-Tuning & RL)
Robotics ML Research Scientist (Fine-Tuning & RL)

Generalist • San Francisco (CA)

On-site
USD 120,000 - 160,000
Staff AI Evaluation Scientist
Staff AI Evaluation Scientist

Visa Hunt • San Francisco (CA), Northern (KY)

Hybrid
USD 140,000 - 200,000
Stock options
Health & wellness
Meals provided
+4
Senior AI Research Engineer – Production ML & Evaluation
Senior AI Research Engineer – Production ML & Evaluation

TRM Labs • United States

On-site
USD 200,000 - 275,000
Equity plan
ML Systems Engineer for RL & Inference Infrastructure
ML Systems Engineer for RL & Inference Infrastructure

Advanced Micro Devices • Santa Clara (CA)

Hybrid
USD 160,000 - 210,000
AMD benefits
Evaluation Platform Engineer: Build Scalable ML Benchmarks
Evaluation Platform Engineer: Build Scalable ML Benchmarks

Thinking Machines Lab • San Francisco (CA)

On-site
USD 300,000 - 475,000
Health, dental, and vision benefits
Unlimited PTO
Paid parental leave
+1