Remote Evaluator for Long-Horizon Planning Reasoning

AI Trainer Jobs

United States

Remote

USD 28,000 - 55,000

Part time

2 days ago
Be an early applicant
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Job summary

AI Trainer Jobs is seeking a remote contractor to review long horizon planning reasoning outputs. You will assess outputs against a published rubric, label edge cases, and provide structured feedback for retraining the model.

The role emphasizes careful, repeatable annotation and documentation of results. The position requires prior evaluation or annotation experience, strong written reasoning, and reliable async availability for at least 10 hours per week; compensation is hourly and determined

Qualifications

  • Prior evaluation, annotation, or human-rater experience on long horizon planning reasoning evaluation or adjacent content.
  • Ability to apply multi-page rubrics consistently across long batches.
  • Clear written reasoning naming the issue and rubric clause applied.
  • Reliable asynchronous availability for at least 10 hours per week.

Responsibilities

  • Evaluate long horizon planning reasoning evaluation model outputs against a versioned rubric and assign severity tags.
  • Compare paired responses and select the stronger answer with a written rationale.
  • Label hallucinations, instruction-following failures, and unsafe content with structured tags.
  • Capture ambiguous prompts and route them back to the program team for rubric updates.

Job description

AI Trainer Jobs is seeking a remote contractor to review long horizon planning reasoning outputs. You will assess outputs against a published rubric, label edge cases, and provide structured feedback for retraining the model.

The role emphasizes careful, repeatable annotation and documentation of results. The position requires prior evaluation or annotation experience, strong written reasoning, and reliable async availability for at least 10 hours per week; compensation is hourly and determined

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Remote AI Research & Reasoning Reviewer
Remote AI Research & Reasoning Reviewer

AI Trainer Jobs • United States

Remote
USD 136,000 - 194,000
Remote Long-Horizon Model Evaluation Specialist
Remote Long-Horizon Model Evaluation Specialist

AI Trainer Jobs • United States

Remote
USD 30,000 - 55,000
Remote work
Contractor role
Long-Horizon Planning Reasoning Reviewer
Long-Horizon Planning Reasoning Reviewer

AI Trainer Jobs • United States

Remote
USD 28,000 - 55,000
Historical Reasoning AI Evaluator — Remote Quality Feedback
Historical Reasoning AI Evaluator — Remote Quality Feedback

AI Trainer Jobs • United States

Remote
USD 34,000 - 55,000
Remote Causal Reasoning Evaluation Specialist
Remote Causal Reasoning Evaluation Specialist

AI Trainer Jobs • United States

Remote
USD 58,000 - 80,000
Remote English Evaluation & Rubric Specialist
Remote English Evaluation & Rubric Specialist

AI Trainer Jobs • United States

Remote
USD 2,066,000 - 3,444,000
Remote Frontier AI/Software Evaluator & Feedback Specialist
Remote Frontier AI/Software Evaluator & Feedback Specialist

AI Trainer Jobs • United States

Remote
USD 110,000 - 165,000
Remote Data Evaluator for Model Feedback & Rubrics
Remote Data Evaluator for Model Feedback & Rubrics

AI Trainer Jobs • United States

Remote
USD 21,000 - 34,000
Remote AI Model Evaluation Specialist (Robot Trajectory)
Remote AI Model Evaluation Specialist (Robot Trajectory)

AI Trainer Jobs • United States

Remote
USD 3,444,000 - 6,199,000
Remote Statistician: AI Reasoning & Method Validation
Remote Statistician: AI Reasoning & Method Validation

AI Trainer Jobs • Northern (KY)

Hybrid
USD 85,000 - 121,000
Remote work – US-eligible