Generative AI Research Scientist: LLM Post-Training

Scale AI, Inc.

New York, Northern (NY, KY)

Hybrid

USD 181,000 - 226,000

Full time

14 days+
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Benefits offered by this job

Health, dental and vision coverage
Retirement benefits
Learning and development stipend
Generous PTO
Commuter stipend

Job summary

Scale AI, Inc. is seeking Research Scientists and Research Engineers with expertise in LLM post-training (SFT, RLHF, reward modeling) to optimize data curation and evaluation for improved LLM capabilities in text and multimodal modalities.

You will develop novel methods and collaborate with leading labs to influence the next generation of generative AI. The role emphasizes rigorous research, experimentation with bias mitigation, and dissemination of findings at major conferences and journals.

Qualifications

  • Ph.D. or Master’s degree in Computer Science, Machine Learning, AI, or a related field.
  • Deep understanding of deep learning, reinforcement learning, and large-scale model fine-tuning.
  • Experience with post-training techniques such as RLHF, preference modeling, or instruction tuning.
  • Excellent written and verbal communication skills.
  • Published research in areas of machine learning at major conferences (NeurIPS, ICML, ICLR, ACL, EMNLP, CVPR, etc.) and/or journals.
  • Previous experience in a customer facing role.

Responsibilities

  • Research and develop novel post-training techniques to enhance LLM core capabilities.
  • Design and experiment new approaches to preference optimization.
  • Analyze model behavior, identify weaknesses, and propose solutions for bias mitigation and model robustness.
  • Publish research findings in top-tier AI conferences.

Skills

Deep learning
Reinforcement learning
Large-scale fine-tuning
Research communication

Education

PhD in CS/ML
Master's in CS/ML

Tools

RLHF tooling
SFT
Preference modeling
Instruction tuning

Job description

Scale AI, Inc. is seeking Research Scientists and Research Engineers with expertise in LLM post-training (SFT, RLHF, reward modeling) to optimize data curation and evaluation for improved LLM capabilities in text and multimodal modalities.

You will develop novel methods and collaborate with leading labs to influence the next generation of generative AI. The role emphasizes rigorous research, experimentation with bias mitigation, and dissemination of findings at major conferences and journals.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

GenAI Research Scientist — LLM Post-Training
GenAI Research Scientist — LLM Post-Training

Scale AI • Seattle (WA)

On-site
USD 166,000 - 207,000
Health coverage
Dental coverage
Vision coverage
+3
LLM Post-Training Research Scientist
LLM Post-Training Research Scientist

Scale AI, Inc. • Seattle (WA)

On-site
USD 181,000 - 226,000
Health, dental and vision coverage
Retirement benefits
Learning and development stipend
+2
LLM Post-Training Research Scientist (SFT & RLHF)
LLM Post-Training Research Scientist (SFT & RLHF)

Scale AI, Inc. • New York (NY)

On-site
USD 181,000 - 226,000
Health, dental & vision coverage
Retirement benefits
Learning and development stipend
+2
LLM Post-Training Scientist - SFT & RLHF
LLM Post-Training Scientist - SFT & RLHF

Scale AI, Inc. • San Francisco (CA)

On-site
USD 181,000 - 226,000
Health benefits
Retirement plan
Learning stipend
+2
LLM Post-Training Research Scientist (SFT/RLHF)
LLM Post-Training Research Scientist (SFT/RLHF)

Scale AI • New York (NY)

On-site
USD 181,000 - 226,000
Health, dental and vision coverage
Retirement benefits
Learning & development stipend
+2
Post-Training ML Research Scientist (RLHF/SFT)
Post-Training ML Research Scientist (RLHF/SFT)

United States Digital Space LLC • New York (NY), San Francisco (CA)

On-site
USD 181,000 - 226,000
Health coverage
Equity
Generous PTO
+2
LLM Evaluation Scientist — Benchmarks & Failure Analysis
LLM Evaluation Scientist — Benchmarks & Failure Analysis

Scale AI, Inc. • Seattle (WA)

On-site
USD 181,000 - 226,000
Health, dental and vision coverage
Retirement benefits
Learning and development stipend
+3
GenAI Evaluation Scientist: LLM Benchmarks & Diagnostics
GenAI Evaluation Scientist: LLM Benchmarks & Diagnostics

Scale AI • San Francisco (CA)

On-site
USD 166,000 - 207,000
Health coverage
Equity
Retirement benefits
+3
GenAI Evaluation Scientist: LLM Benchmarks & Diagnostics
GenAI Evaluation Scientist: LLM Benchmarks & Diagnostics

Neura Market • San Francisco (CA), Northern (KY)

Hybrid
USD 181,000 - 226,000
Health coverage
Retirement benefits
Learning stipend
+2
GenAI Evaluation Scientist — Benchmark & Diagnose LLMs
GenAI Evaluation Scientist — Benchmark & Diagnose LLMs

Scale AI, Inc. • New York (NY)

On-site
USD 181,000 - 226,000
Base salary + equity
Health, dental, vision coverage
Retirement benefits
+3