Senior Safety Evaluation Engineer (ML Metrics)

Meta Careers

Menlo Park (CA)

On-site

USD 219,000 - 301,000

Full time

14 days+
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Job summary

Meta is seeking a Research Engineer to advance Safety Evaluation for its frontier AI systems. You will set the strategy across model families and modalities, design novel safety evaluations, and build a distributed platform to run extensive checks against training checkpoints and production traffic.

You will translate policy and regulatory standards into concrete measurement criteria while mentoring researchers and communicating results to leadership.

Qualifications

  • Experience designing and validating evaluations or benchmarks for ML systems, including metric reliability and failure modes.
  • Hands-on work with LLMs, multimodal models, or NLP across production or research environments.
  • Ability to communicate technical results to non-technical stakeholders and drive decisions across teams.

Responsibilities

  • Set the technical strategy for safety evaluation across multiple model families and modalities.
  • Design, implement, and validate novel evaluations for safety-critical behaviors (policy adherence, adversarial robustness, agentic risk).
  • Build and harden distributed evaluation platforms to run hundreds of evals at scale during training.

Skills

Python
PyTorch
ML/AI
LLMs

Education

Bachelor's degree in CS/Engineering or equivalent

Tools

PyTorch

Job description

Meta is seeking a Research Engineer to advance Safety Evaluation for its frontier AI systems. You will set the strategy across model families and modalities, design novel safety evaluations, and build a distributed platform to run extensive checks against training checkpoints and production traffic.

You will translate policy and regulatory standards into concrete measurement criteria while mentoring researchers and communicating results to leadership.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Lead AI Safety Evaluation Engineer
Lead AI Safety Evaluation Engineer

RiseMe • Menlo Park (CA)

On-site
USD 219,000 - 301,000
Bonus
Equity
Benefits
Research Engineer, Safety Evaluation
Research Engineer, Safety Evaluation

RiseMe • Menlo Park (CA)

On-site
USD 219,000 - 301,000
Bonus
Equity
Benefits
Research Engineer, Safety Evaluation
Research Engineer, Safety Evaluation

Meta Careers • Menlo Park (CA)

On-site
USD 219,000 - 301,000
Data Scientist, AI Safety & Risk Analytics
Data Scientist, AI Safety & Risk Analytics

Meta • Menlo Park (CA)

On-site
USD 180,000 - 230,000
Staff ML Inference Systems Engineer, Real-Time Safety
Staff ML Inference Systems Engineer, Real-Time Safety

EngineersOfAI • San Francisco (CA), Northern (KY)

Hybrid
USD 272,000 - 368,000
Systems & ML Infra Engineer for Frontier AI Evaluations
Systems & ML Infra Engineer for Frontier AI Evaluations

Meta • Menlo Park (CA), Northern (KY)

Hybrid
USD 180,000 - 240,000
Remote ML Engineer - Safety & AI Evaluation
Remote ML Engineer - Safety & AI Evaluation

Aisafety • Washington

On-site
USD 130,000 - 200,000
Performance-based annual bonus
Support for professional development
Generous PTO and paid holiday schedule
Staff ML Inference Engineer - Safety Platform & Scale
Staff ML Inference Engineer - Safety Platform & Scale

Socket.dev • San Francisco (CA)

Hybrid
USD 320,000 - 485,000
Equity donation matching
Generous vacation
Parental leave
+2
Engineering Manager, Web Safety ML Systems
Engineering Manager, Web Safety ML Systems

SupportFinity™ • San Francisco (CA)

On-site
USD 180,000 - 240,000
Staff+ ML Safety Infrastructure Engineer
Staff+ ML Safety Infrastructure Engineer

Anthropic • San Francisco (CA)

On-site
USD 180,000 - 280,000
Health insurance
Dental insurance
Vision insurance
+8