Causal Reasoning Model Evaluation Specialist

AI Trainer Jobs

United States

Remote

USD 58,000 - 80,000

Full time

2 days ago
Be an early applicant
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Job summary

AI Trainer Jobs is seeking a Causal Reasoning Model Evaluation Specialist for a remote, US-eligible contractor track. You will review AI outputs across causal reasoning evaluation, examine reasoning and calculations, and contribute to research workflows.

Responsibilities include reproducing key derivations, grading reasoning quality, and documenting the correct methods so the modeling team can train on them. Strong rubric use and clear written work are essential.

Qualifications

  • PhD, postdoc, or industry research experience in causal reasoning model evaluation.
  • Experience publishing or teaching on the topic at a professional level.
  • Multilingual fluency for non-English papers and corpora.

Responsibilities

  • Review AI outputs against current causal reasoning evaluation methods.
  • Reproduce or sanity-check key derivations and calculations.
  • Flag errors with structured severity tags and document corrections.
  • Audit batches for rubric consistency and report drift.

Skills

Scientific reasoning
Method validation
Citation review
Quantitative analysis
Causal reasoning
Rubric calibration
Failure analysis
Reasoning

Education

PhD or equivalent

Job description

Causal Reasoning Model Evaluation Specialist is a remote review track for evaluating AI outputs across causal reasoning model evaluation research review reasoning, calculations, and research workflows. Reviewers grade derivations and assumptions, reproduce key results, and document the correct method so the modeling team can train on it.

Category: Math, Reasoning & Formal Methods · Pay: $50 / hr · Location: Remote — US-eligible · Contractor

Causal Reasoning Model Evaluation Specialist is a remote review track for evaluating AI outputs across causal reasoning model evaluation research review reasoning, calculations, and research workflows.

About the role

Causal Reasoning Model Evaluation Specialist is a remote review track for evaluating AI outputs across causal reasoning model evaluation research review reasoning, calculations, and research workflows.
Causal Reasoning Model Evaluation research review models live or die on whether their derivations actually hold up under scrutiny.
Judge mathematical reasoning and theorem proving. Long proof chains included.

Responsibilities
  • Review AI outputs against current causal reasoning model evaluation research review methods, conventions, and prior work for Causal Reasoning Model Evaluation Specialist assignments.
  • Reproduce or sanity-check key derivations, calculations, or experimental claims.
  • Flag dimensional, methodological, and citation errors with structured severity tags.
  • Capture the corrected reasoning or worked example so the modeling team can train on it.
Role details

Track STEM research review Work model Remote · Independent specialist contractor Compensation Hourly rate confirmed after the interview process. Eligible from US

What you should bring
  • Graduate-level training or equivalent applied experience in causal reasoning model evaluation research review or a closely related field for Causal Reasoning Model Evaluation Specialist work.
  • Hands-on experience publishing, teaching, or advising on the topic at a professional level.
  • Comfort applying multi-page rubrics consistently across long batches.
  • Clear written reasoning that cites methods, papers, or worked examples.
  • Reliable async availability for at least 10 hours per week.
Example tasks
  • Reproduce a causal reasoning model evaluation research review derivation from a model output and flag any algebraic or dimensional errors.
  • Grade a model's literature summary against the cited papers and rate the citation quality.
  • Adjudicate a disputed answer between two reviewers using textbook methods.
  • Audit a 25-row batch for rubric consistency and report drift to the program lead.
Useful experience
  • PhD, postdoc, or industry research experience in the topic area.
  • Prior work reviewing AI-assisted research tooling and its failure modes.
  • Multilingual fluency for non-English papers and corpora.
Compensation and schedule

Hourly rate confirmed after the interview process.
Expected arrangement: contractor , with program-defined task volume and review pacing. Placement depends on current program demand and reviewer confirmation.

Skills used in matching
  • Scientific reasoning
  • Method validation
  • Citation review
  • Quantitative analysis
  • Causal Reasoning Model Evaluation research review
  • Frontier evaluation
  • Rubric calibration
  • Failure analysis
  • Causal
  • Reasoning
Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Research & Insights Expert
Research & Insights Expert

AI Trainer Jobs • United States

Remote
USD 152,000 - 207,000
Proof Verification Model Evaluator
Proof Verification Model Evaluator

AI Trainer Jobs • United States

Remote
USD 55,000 - 83,000
Graduate Math Model Evaluator
Graduate Math Model Evaluator

AI Trainer Jobs • United States

Remote
USD 69,000 - 76,000
Survey Research & Consumer Insights Expert
Survey Research & Consumer Insights Expert

AI Trainer Jobs • United States

Remote
USD 141,000 - 190,000
Remote Causal Reasoning Evaluation Specialist
Remote Causal Reasoning Evaluation Specialist

AI Trainer Jobs • United States

Remote
USD 58,000 - 80,000
Member of Technical Staff, Research Engineering
Member of Technical Staff, Research Engineering

AI Trainer Jobs • United States

On-site
USD 330,624,000 - 358,176,000
Market research / competitive intelligence Evaluator
Market research / competitive intelligence Evaluator

AI Trainer Jobs • United States

Remote
USD 110,000 - 165,000
UK-Based Market Research & Market Entry Specialists
UK-Based Market Research & Market Entry Specialists

AI Trainer Jobs • United States

Remote
USD 179,000 - 214,000
Remote work
PhD & Academic Expert
PhD & Academic Expert

AI Trainer Jobs • United States

Remote
USD 141,000 - 190,000
Coq Formalization Model Evaluator
Coq Formalization Model Evaluator

AI Trainer Jobs • United States

Remote
USD 55,000 - 83,000