Post-Training AI Researcher — Enterprise LLM Alignment

Distyl

New York, San Francisco (NY, CA)

Hybrid

USD 150,000 - 250,000

Full time

14 days+
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Benefits offered by this job

Equity
Medical insurance
Flexible time off
401(k) plan
Commuter benefits
In-office lunches
Access to AI models
High-impact projects
Mission-driven culture

Job summary

Distyl AI is seeking researchers to join our Post-Training team, translating foundation models into enterprise-ready systems. You will work on supervised fine-tuning, preference optimization, and continual adaptation to align models with Distyl’s workflows.

You will shape how AI-native operations are deployed across industries, building prototypes and conducting experiments that demonstrate impact using real-world data.

Qualifications

  • Deep understanding of post-training techniques including supervised fine-tuning, preference optimization (RLHF/DPO), LoRA/PEFT, and instruction-tuning pipelines.
  • Experience adapting frontier models to specialized domains or behaviors through data curation or continual pretraining.
  • Experience building intelligent systems using models as components rather than only training models.
  • Proven track record of research results via publications or public demonstrations.
  • Active use of AI tools (e.g., ChatGPT, Cursor, Perplexity) to accelerate workflows.
  • Strong programming and data analysis skills with ability to prototype and run experiments.

Responsibilities

  • The Post-Training team adapts foundation models to real-world performance and alignment, developing techniques to align models with enterprise systems.
  • Researchers investigate alignment methods, considering generalization vs. specialization and data efficiency vs. robustness.

Skills

Post-training techniques
Frontier-model adaptation
Prototyping with AI systems
Research track record
Hands-on AI tooling

Tools

Python
PyTorch
RLHF/DPO
LoRA/PEFT

Job description

Distyl AI is seeking researchers to join our Post-Training team, translating foundation models into enterprise-ready systems. You will work on supervised fine-tuning, preference optimization, and continual adaptation to align models with Distyl’s workflows.

You will shape how AI-native operations are deployed across industries, building prototypes and conducting experiments that demonstrate impact using real-world data.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Applied AI Researcher, Post-Training
Applied AI Researcher, Post-Training

Distyl • New York (NY), San Francisco (CA)

Hybrid
USD 150,000 - 250,000
Equity
Medical insurance
Flexible time off
+6
Applied AI Systems Architect
Applied AI Systems Architect

Distyl • New York (NY), San Francisco (CA)

Hybrid
USD 150,000 - 250,000
Equity
Full benefits package
Flexible time off
+2
Applied AI Research Engineer - Post-Training (Hybrid, Equity)
Applied AI Research Engineer - Post-Training (Hybrid, Equity)

Distyl • New York (NY)

Hybrid
USD 150,000 - 250,000
Equity compensation
Medical insurance
Flexible time off
+7
Enterprise Self-Improving AI Researcher
Enterprise Self-Improving AI Researcher

Distyl • New York (NY), San Francisco (CA)

Hybrid
USD 150,000 - 250,000
Equity
Health insurance
Flexible time off
+6
Enterprise AI Benchmarking Architect & Evaluation Lead
Enterprise AI Benchmarking Architect & Evaluation Lead

Distyl • San Francisco (CA)

Hybrid
USD 150,000 - 250,000
Equity
Medical, dental, vision
Flexible time off
+4
Applied Post-Training LLM Research Scientist
Applied Post-Training LLM Research Scientist

Modal Labs • New York (NY)

On-site
USD 180,000 - 240,000
Applied AI Post-Training Engineer
Applied AI Post-Training Engineer

Distyl • San Francisco (CA)

Hybrid
USD 150,000 - 250,000
Equity
Insurance coverage
Flexible time off
+5
LLM Alignment & Post-Training Research Scientist
LLM Alignment & Post-Training Research Scientist

Scale AI • New York (NY)

On-site
USD 150,000 - 200,000
Health & wellbeing benefits
Learning & development stipend
Community & ERG events
+1
Research Engineers, Post-Training
Research Engineers, Post-Training

Distyl • New York (NY)

Hybrid
USD 150,000 - 250,000
Equity compensation
Medical insurance
Flexible time off
+7
Research Engineers, Post-Training
Research Engineers, Post-Training

Distyl • San Francisco (CA)

Hybrid
USD 150,000 - 250,000
Equity
Insurance coverage
Flexible time off
+5