PhD-Level AI Model Evaluator & Domain Expert (Remote)

Braintrust

United States

Remote

AUD 173,000 - 288,000

Part time

10 days ago
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

Braintrust is seeking PhD-level experts to help train and evaluate advanced AI models. This fully remote, flexible contract work shapes how models reason, answer, and improve.

You will review AI-generated content in your field, identify where the model is correct or incorrect, and help raise the quality bar on technical reasoning. The short-term engagement runs through the end of June, with potential to extend.

Qualifications

  • PhD completed or near completion in ML/AI, CS, engineering, statistics or related field.
  • Strong analytical and critical-thinking abilities to spot subtle errors in technical reasoning.
  • Fluent written English for clear technical communication.
  • Nice-to-have: research experience and data annotation or model evaluation.

Responsibilities

  • Assessing the factuality and relevance of domain-specific text produced by AI models.
  • Crafting and answering questions related to Machine Learning and AI.
  • Evaluating and ranking domain-specific responses generated by AI models.

Skills

Analytical thinking
Critical thinking
Fluent English writing

Education

PhD in ML/AI/CS/Engineering/Statistics or related

Job description

Braintrust is seeking PhD-level experts to help train and evaluate advanced AI models. This fully remote, flexible contract work shapes how models reason, answer, and improve.

You will review AI-generated content in your field, identify where the model is correct or incorrect, and help raise the quality bar on technical reasoning. The short-term engagement runs through the end of June, with potential to extend.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

AI Model Evaluation Scientist (PhD) — Remote Contract
AI Model Evaluation Scientist (PhD) — Remote Contract

Braintrust • Puerto Rico

On-site
USD 124,000 - 207,000
STEM PhD Expert for AI Reasoning & Evaluation
STEM PhD Expert for AI Reasoning & Evaluation

Braintrust • United States

Remote
AUD 173,000 - 288,000
Remote AI Finance Research Evaluator (Contract)
Remote AI Finance Research Evaluator (Contract)

Braintrust • Puerto Rico

On-site
USD 90,000 - 130,000
Remote work
Short-term engagement through June
AI Research Expert (PhD) — Remote, Critical Analysis
AI Research Expert (PhD) — Remote, Critical Analysis

YO AI Labs • Austin (TX)

Remote
USD 90,000 - 130,000
AI Research Quality Evaluator — Remote (PhD Expert)
AI Research Quality Evaluator — Remote (PhD Expert)

YO AI Labs • California City (CA)

Remote
USD 96,000 - 165,000
Remote AI Research Evaluator (PhD Preferred)
Remote AI Research Evaluator (PhD Preferred)

YO AI Labs • San Francisco (CA)

Remote
USD 80,000 - 120,000
AI Research Evaluator & Subject-Matter Expert Remote
AI Research Evaluator & Subject-Matter Expert Remote

YO AI Labs • Los Angeles (CA)

Remote
USD 83,000 - 165,000
Remote PhD & Academic Expert — AI Research Evaluator
Remote PhD & Academic Expert — AI Research Evaluator

YO AI Labs • Washington

Remote
USD 83,000 - 124,000
Remote AI Data Science Domain Expert & Evaluator
Remote AI Data Science Domain Expert & Evaluator

YO AI Labs • Austin (TX)

Remote
USD 83,000 - 96,000
AI Research Expert — Remote, PhD Level
AI Research Expert — Remote, PhD Level

YO AI Labs • Boston (MA)

Remote
USD 83,000 - 152,000