RL Data & Domain Strategy Engineer

Anthropic

Seattle (WA)

Hybrid

USD 350,000 - 850,000

Full time

14 days+
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

Anthropic in Seattle is seeking a skilled professional for the Domain Scaling team. This role focuses on enhancing AI capabilities in finance, healthcare, and legal domains via reinforcement learning environments. You will manage vendor relationships, design reward signals, and measure model performance.

The ideal candidate has experience fine-tuning large language models and a strong collaboration background. The position offers a competitive salary based on qualifications and experience.

Qualifications

  • Experience with fine-tuning large language models for specific domains or real-world use cases.
  • Experience with reinforcement learning, reward design, or training data curation for LLMs.
  • Comfortable managing technical vendor relationships.
  • Strong cross-functional collaboration skills.
  • Passion for making AI more useful across industries.

Responsibilities

  • Own the data strategy for knowledge work verticals end-to-end.
  • Manage technical relationships with external data vendors.
  • Collaborate with domain experts to design data pipelines.
  • Explore ways of creating RL environments for high-value tasks.
  • Develop and improve QA frameworks to ensure quality.
  • Run experiments to measure data strategy impacts.
  • Partner with RL research teams to align goals with evaluations.

Skills

Fine-tuning large language models
Reinforcement learning
Reward design
Data curation
Cross-functional collaboration

Education

Bachelor’s degree or equivalent

Job description

Anthropic in Seattle is seeking a skilled professional for the Domain Scaling team. This role focuses on enhancing AI capabilities in finance, healthcare, and legal domains via reinforcement learning environments. You will manage vendor relationships, design reward signals, and measure model performance.

The ideal candidate has experience fine-tuning large language models and a strong collaboration background. The position offers a competitive salary based on qualifications and experience.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

RL Data & Domain Strategy Engineer
RL Data & Domain Strategy Engineer

Anthropic • San Francisco (CA)

Hybrid
USD 350,000 - 850,000
Domain-Scaling Research Engineer | RL Environments
Domain-Scaling Research Engineer | RL Environments

Anthropic • San Francisco (CA)

On-site
USD 350,000 - 850,000
Generous vacation and parental leave
Optional equity donation matching
Flexible working hours
Research Engineer, Domain Scaling — Real-World RL
Research Engineer, Domain Scaling — Real-World RL

Contentbuffer • San Francisco (CA)

Hybrid
USD <1,000
Research Engineer: RL Environments & Domain Data Strategy
Research Engineer: RL Environments & Domain Data Strategy

Menlo Ventures • New York (NY)

Hybrid
USD 350,000 - 850,000
Generous vacation and parental leave
Flexible working hours
Lovely office space
Research Engineer, Domain Scaling
Research Engineer, Domain Scaling

Menlo Ventures • New York (NY)

On-site
USD 350,000 - 850,000
Generous vacation and parental leave
Flexible working hours
Lovely office space
R Research Engineer, Domain Scaling San Francisco, CA, US Mid LLM machine learning reinforcemen[...]
R Research Engineer, Domain Scaling San Francisco, CA, US Mid LLM machine learning reinforcemen[...]

Contentbuffer • San Francisco (CA)

Hybrid
USD <1,000
Research Engineer, Domain Scaling
Research Engineer, Domain Scaling

Anthropic • San Francisco (CA)

Hybrid
USD 350,000 - 850,000
Research Engineer, Domain Scaling
Research Engineer, Domain Scaling

Anthropic • Seattle (WA)

Hybrid
USD 350,000 - 850,000
Domain Scaling Engineer: RL Data & Environments
Domain Scaling Engineer: RL Data & Environments

Normal Computing Corporation • New York (NY)

Hybrid
USD 140,000 - 210,000
RL Research Engineer - Scalable, Safe AI Systems
RL Research Engineer - Scalable, Safe AI Systems

Anthropic • San Francisco (CA)

Hybrid
USD 500,000 - 850,000
Competitive compensation
Equity donation matching
Generous vacation and parental leave
+2