AI Benchmark Scientist - Materials Science & Modeling (PhD)

Obsidian

New York (NY)

On-site

USD 83,000 - 138,000

Part time

7 days ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Mercor is hiring PhD and Master's scientists to author AI evaluation tasks and participate in a new benchmark for scientific computing. You will author original, executable research problems that frontier models cannot solve, focusing on materials science and related subdomains with coding.

The role involves sourcing material, crafting prompts, defining grading criteria, and calibrating models. This is a 6-week, part-time engagement requiring 20+ hours per week with immediate start.

Qualifications

  • PhD in materials science or related field.
  • Depth in semiconductor materials and molecular modeling.
  • Proficiency in Python or R for scientific computing.
  • Experience with Git/GitHub and Docker in PR workflows.

Responsibilities

  • Source your own material from papers, datasets, repositories, or a scenario you design.
  • Write scientific prompts based on the input.
  • Build the grading criteria that define a correct answer.
  • Calibrate against frontier models—a task ships only when strong models fail it more often than they succeed.

Skills

Python
R

Education

PhD in materials science

Tools

Docker
Git/GitHub

Job description

Mercor is hiring PhD and Master's scientists to author AI evaluation tasks and participate in a new benchmark for scientific computing. You will author original, executable research problems that frontier models cannot solve, focusing on materials science and related subdomains with coding.

The role involves sourcing material, crafting prompts, defining grading criteria, and calibrating models. This is a 6-week, part-time engagement requiring 20+ hours per week with immediate start.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

PhD Materials Scientist — AI Benchmarking in Modeling
PhD Materials Scientist — AI Benchmarking in Modeling

Mercor • United States

Remote
USD 67,000 - 100,000
Materials Scientist: AI Benchmarking & Research Prompts
Materials Scientist: AI Benchmarking & Research Prompts

Obsidian • San Francisco (CA)

Remote
USD 8,266,000 - 12,398,000
Materials Science PhD — AI Benchmark Architect
Materials Science PhD — AI Benchmark Architect

Mercor • New York (NY)

On-site
USD 83,000 - 124,000
AI Benchmark Scientist — Quantum & Computational Chemistry
AI Benchmark Scientist — Quantum & Computational Chemistry

Mercor • United States

Remote
USD 83,000 - 124,000
AI Benchmark Scientist for Biochemistry & Genomics
AI Benchmark Scientist for Biochemistry & Genomics

Obsidian • San Francisco (CA)

Remote
USD 273,000 - 382,000
AI Evaluation Scientist Math PhD Frontier Model Benchmark
AI Evaluation Scientist Math PhD Frontier Model Benchmark

Obsidian • San Francisco (CA)

On-site
USD 96,000 - 179,000
AI Benchmark Scientist - Physics PhD (6-Week, Part-Time)
AI Benchmark Scientist - Physics PhD (6-Week, Part-Time)

Mercor • United States

Remote
USD 83,000 - 124,000
AI Evaluation Scientist (PhD) — Math & Frontiers Benchmarking
AI Evaluation Scientist (PhD) — Math & Frontiers Benchmarking

Obsidian • Miami (FL)

On-site
USD 83,000 - 124,000
AI Benchmark Architect for Scientific Computing
AI Benchmark Architect for Scientific Computing

Obsidian • San Francisco (CA)

Remote
USD 96,000 - 138,000
6-week engagement
Part-time 20+ hrs/week
Immediate start
Quantum Computing Scientist for AI Benchmarks (PhD)
Quantum Computing Scientist for AI Benchmarks (PhD)

Mercor • San Francisco (CA)

On-site
USD 124,000 - 165,000