Materials Science PhD — AI Benchmark Architect

Mercor

New York (NY)

On-site

USD 83,000 - 124,000

Part time

7 days ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Mercor is hiring PhD and Master's scientists to author AI evaluation tasks for Sci Code. You will craft original, executable research problems that frontier models cannot solve.

Domains include materials science with a focus on semiconductor materials and molecular modeling. You will source material, write prompts, define grading criteria, and calibrate against models, ensuring tasks challenge state-of-the-art systems.

Qualifications

  • PhD in materials science, materials engineering, applied physics, chemistry, or related field.
  • Depth in semiconductor materials and molecular modeling.
  • Proficiency in Python, R, or similar scientific computing languages.
  • Experience with Git/GitHub and Docker in PR-driven workflows.

Responsibilities

  • Source your own material from papers, datasets, or open repositories.
  • Write scientific prompts based on inputs.
  • Develop grading criteria for correct answers.
  • Calibrate prompts against frontier models to fail cases.

Skills

Python
R
Git/GitHub
Docker

Education

PhD in Materials Science
Master's degree in related field

Tools

Docker
GitHub

Job description

Mercor is hiring PhD and Master's scientists to author AI evaluation tasks for Sci Code. You will craft original, executable research problems that frontier models cannot solve.

Domains include materials science with a focus on semiconductor materials and molecular modeling. You will source material, write prompts, define grading criteria, and calibrate against models, ensuring tasks challenge state-of-the-art systems.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

PhD Materials Scientist — AI Benchmarking in Modeling
PhD Materials Scientist — AI Benchmarking in Modeling

Mercor • United States

Remote
USD 67,000 - 100,000
Materials Scientist: AI Benchmarking & Research Prompts
Materials Scientist: AI Benchmarking & Research Prompts

Obsidian • San Francisco (CA)

Remote
USD 8,266,000 - 12,398,000
AI Benchmark Scientist - Materials Science & Modeling (PhD)
AI Benchmark Scientist - Materials Science & Modeling (PhD)

Obsidian • New York (NY)

On-site
USD 83,000 - 138,000
Materials Science PhD - AI Evaluator
Materials Science PhD - AI Evaluator

Mercor • New York (NY)

On-site
USD 83,000 - 124,000
Materials Science PhD - AI Evaluator
Materials Science PhD - AI Evaluator

Obsidian • New York (NY)

On-site
USD 83,000 - 138,000
AI Evaluation Scientist (PhD) — Math & Frontiers Benchmarking
AI Evaluation Scientist (PhD) — Math & Frontiers Benchmarking

Obsidian • Miami (FL)

On-site
USD 83,000 - 124,000
Quantum Chemistry AI Researcher & Code Architect
Quantum Chemistry AI Researcher & Code Architect

Obsidian • San Diego (CA)

On-site
USD 83,000 - 124,000
Quantum Computing Scientist for AI Benchmarks (PhD)
Quantum Computing Scientist for AI Benchmarks (PhD)

Mercor • San Francisco (CA)

On-site
USD 124,000 - 165,000
PhD Quantum Computing Scientist — AI Benchmarking
PhD Quantum Computing Scientist — AI Benchmarking

Obsidian • New York (NY)

On-site
USD 55,000 - 110,000
AI Evaluation Scientist Math PhD Frontier Model Benchmark
AI Evaluation Scientist Math PhD Frontier Model Benchmark

Obsidian • San Francisco (CA)

On-site
USD 96,000 - 179,000