Staff AI Engineer - Post-Training & Agentic RL

Hark

San Jose (CA)

On-site

USD 180,000 - 450,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Hark in San Jose, California is seeking a Member of Technical Staff to lead the development of strategies for coding agents using reinforcement learning. The role involves designing experiments, building evaluation frameworks, and collaborating across teams to implement improvements driven by research insights.

Strong candidates should have a background in machine learning, particularly within reinforcement learning, with skills in Python and PyTorch, and an ability to work in fast-paced, research-oriented settings.

Qualifications

  • Strong background in machine learning with experience in large model training.
  • Deep understanding of reinforcement learning concepts and techniques.
  • Proficiency in Python and experience with PyTorch.
  • Ability to design rigorous experiments and diagnose issues.

Responsibilities

  • Design and implement post-training strategies for coding agents.
  • Build simulation and scaffolding environments for agentic RL.
  • Develop reward modeling pipelines for training agents.
  • Scale synthetic data generation and improve training efficiency.
  • Build evaluation frameworks to measure the progress of agents.
  • Collaborate to translate research insights into improvements.

Skills

Machine learning
Reinforcement learning
Python
PyTorch
Simulation environments

Job description

Hark in San Jose, California is seeking a Member of Technical Staff to lead the development of strategies for coding agents using reinforcement learning. The role involves designing experiments, building evaluation frameworks, and collaborating across teams to implement improvements driven by research insights.

Strong candidates should have a background in machine learning, particularly within reinforcement learning, with skills in Python and PyTorch, and an ability to work in fast-paced, research-oriented settings.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Lead Post-Training AI Engineer for Agentic Coding
Lead Post-Training AI Engineer for Agentic Coding

Hark, Inc. • San Jose (CA)

On-site
USD 180,000 - 450,000
Member of Technical Staff, Post-training San Jose
Member of Technical Staff, Post-training San Jose

Hark, Inc. • San Jose (CA)

On-site
USD 180,000 - 450,000
Real-time Multimodal RL Engineer - Post-Training
Real-time Multimodal RL Engineer - Post-Training

Hark, Inc. • San Jose (CA)

On-site
USD 180,000 - 450,000
Member of Technical Staff, Mid-training San Jose
Member of Technical Staff, Mid-training San Jose

Hark, Inc. • San Jose (CA)

On-site
USD 180,000 - 450,000
Staff Agent Post-Training ML Research Engineer (RLHF/Agents)
Staff Agent Post-Training ML Research Engineer (RLHF/Agents)

Scale • San Francisco (CA), New York (NY)

On-site
USD 265,000 - 331,000
Health, dental and vision coverage
Retirement benefits
Learning and development stipend
+2
Staff ML Engineer, Mid-Level — Training & Agent
Staff ML Engineer, Mid-Level — Training & Agent

Hark • San Jose (CA)

On-site
USD 180,000 - 450,000
Post-Training AI Research Engineer – RL & Agentic Infra
Post-Training AI Research Engineer – RL & Agentic Infra

Storm3 • San Francisco (CA)

On-site
USD 140,000 - 210,000
Medical Insurance
Dental Insurance
Vision Insurance
+2
Member of Technical Staff, Post-training
Member of Technical Staff, Post-training

Hark • San Jose (CA)

On-site
USD 180,000 - 450,000
Member of Technical Staff, Mid-training
Member of Technical Staff, Mid-training

Hark • San Jose (CA)

On-site
USD 180,000 - 450,000
Senior Reinforcement Learning AI Engineer Web Agent
Senior Reinforcement Learning AI Engineer Web Agent

Yutori • San Francisco (CA)

On-site
USD 180,000 - 240,000
Competitive salary and equity
Visa sponsorship and relocation stipend
Generous health, dental, vision insurance
+3