AI Safety & Recursive-Improvement Scientist (RL)

AMD

United States

Hybrid

USD 150,000 - 210,000

Full time

14 days+
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

AMD is seeking an AI Research Scientist to explore recursive self-improvement within safe, bounded regimes. You will study model-generated supervision, automatic curriculum refinement, and data-quality signals, ensuring governance and human oversight are embedded.

The role emphasizes empirical safety evaluation, robustness, and rigorous measurement of distributional shifts in closed-loop training, with collaboration across AI-for-HW and generative AI programs.

Qualifications

  • PhD in Computer Science, Machine Learning, or related field strongly preferred.
  • Publications or substantial work in iterative training, self-training, or open-ended learning is advantageous.
  • Experience with empirical safety evaluation and scalable oversight is desirable.

Responsibilities

  • Research self-improving training loops with model-generated supervision and automated curriculum updates.
  • Develop evaluation methods for capability drift, Goodhart effects, and distributional shift in closed-loop training.
  • Collaborate with RL scientists on RSI objectives intersecting policy optimization and preference learning.
  • Define red-team protocols and monitoring for RSI pilots; document rollback criteria before experiments touch shared infrastructure.
  • Publish technical reports and align internal narratives with responsible deployment standards.

Skills

Machine Learning
AI Safety
Reinforcement Learning
Experimentation

Education

PhD in Computer Science or ML

Tools

Experimentation harnesses

Job description

AMD is seeking an AI Research Scientist to explore recursive self-improvement within safe, bounded regimes. You will study model-generated supervision, automatic curriculum refinement, and data-quality signals, ensuring governance and human oversight are embedded.

The role emphasizes empirical safety evaluation, robustness, and rigorous measurement of distributional shifts in closed-loop training, with collaboration across AI-for-HW and generative AI programs.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Lead AI Research Scientist, Recursive Self Improvement, AI Safety and Reinforcement Learning
Lead AI Research Scientist, Recursive Self Improvement, AI Safety and Reinforcement Learning

AMD • Santa Clara (CA)

On-site
USD 120,000 - 180,000
Director of AI Research - Recursive Self-Improvement
Director of AI Research - Recursive Self-Improvement

Socket.dev • Santa Clara (CA)

On-site
USD 250,000 - 420,000
Lead AI Research Scientist: Safe Self-Improving Systems
Lead AI Research Scientist: Safe Self-Improving Systems

AMD • Santa Clara (CA)

On-site
USD 120,000 - 180,000
Director of AI Research & Recursive Self-Improvement
Director of AI Research & Recursive Self-Improvement

AMD • Santa Clara (CA)

On-site
USD 250,000 - 420,000
AMD benefits at a glance
Strategic AI Safety Researcher for Recursive Self-Improvement
Strategic AI Safety Researcher for Recursive Self-Improvement

OpenAI • San Francisco (CA)

On-site
USD 180,000 - 240,000
AI Research Scientist, Recursive Self Improvement, AI Safety and Reinforcement Learning
AI Research Scientist, Recursive Self Improvement, AI Safety and Reinforcement Learning

AMD • United States

Hybrid
USD 150,000 - 210,000
Director of AI Research & Recursive Self-Improvement
Director of AI Research & Recursive Self-Improvement

Advanced Micro Devices • Santa Clara (CA)

Hybrid
USD 250,000 - 400,000
AMD Benefits
AI Safety Researcher — RLHF & Adversarial Robustness
AI Safety Researcher — RLHF & Adversarial Robustness

Jobtailor • California (MO)

On-site
USD 140,000 - 210,000
Director, AI Research - Recursive Self-Improvement
Director, AI Research - Recursive Self-Improvement

Socket.dev • Santa Clara (CA)

On-site
USD 250,000 - 420,000
RL Research Scientist for Post-Training LLMs & Code Models
RL Research Scientist for Post-Training LLMs & Code Models

Advanced Micro Devices • Santa Clara (CA), Northern (KY)

Hybrid
USD 170,000 - 250,000