Remote RLHF Evaluator: Preference Taxonomy Feedback

AI Trainer Jobs

United States

Remote

USD 34,000 - 55,000

Full time

2 days ago
Be an early applicant
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Job summary

AuraOne seeks a remote evaluator to review preference taxonomy reward model prompts and responses against its quality rubric. You will compare paired outputs, label edge cases, and write structured feedback for retraining the modeling team.

As a contractor, you will contribute to auditable labels, rationales, and regression cases, producing preference rankings and calibrated human judgments for post-training pipelines. Prior evaluation or moderation experience is valued.

Qualifications

  • Experience in evaluation, annotation, or human-rating for preference models.
  • Ability to apply multi-page rubrics consistently across long batches.
  • Clear written reasoning naming the issue and rubric clause.

Responsibilities

  • Evaluate model outputs against a versioned rubric and assign severity tags.
  • Compare paired responses and select the stronger with rationale.
  • Label hallucinations and unsafe content with structured tags.
  • Capture ambiguous prompts for rubric updates.

Skills

Linguistics background
Annotation experience
Inter-rater calibration
Attention to detail
Written reasoning

Job description

AuraOne seeks a remote evaluator to review preference taxonomy reward model prompts and responses against its quality rubric. You will compare paired outputs, label edge cases, and write structured feedback for retraining the modeling team.

As a contractor, you will contribute to auditable labels, rationales, and regression cases, producing preference rankings and calibrated human judgments for post-training pipelines. Prior evaluation or moderation experience is valued.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Remote RLHF QA Evaluator - Preference Data
Remote RLHF QA Evaluator - Preference Data

AI Trainer Jobs • United States

Remote
USD 28,000 - 55,000
Remote work
Preference Taxonomy Reward Model Evaluator
Preference Taxonomy Reward Model Evaluator

AI Trainer Jobs • United States

Remote
USD 34,000 - 55,000
Senior RLHF Preference Data Reviewer - Remote
Senior RLHF Preference Data Reviewer - Remote

AI Trainer Jobs • United States

Remote
USD 34,000 - 55,000
Remote RLHF Data Reviewer: Consensus & Rubric Feedback
Remote RLHF Data Reviewer: Consensus & Rubric Feedback

AI Trainer Jobs • United States

Remote
USD 28,000 - 55,000
Preference Dataset QA Reward Model Evaluator
Preference Dataset QA Reward Model Evaluator

AI Trainer Jobs • United States

Remote
USD 28,000 - 55,000
Remote work
Remote RLHF: Reward Hacking Preference Data Reviewer
Remote RLHF: Reward Hacking Preference Data Reviewer

AI Trainer Jobs • United States

Remote
USD 27,552,000 - 41,328,000
Remote work (US-eligible)
Contractor role
Remote AI Preference Data QA Reviewer & Feedback Specialist
Remote AI Preference Data QA Reviewer & Feedback Specialist

AI Trainer Jobs • United States

Remote
USD 28,000 - 48,000
Remote RLHF Evaluation Specialist — Instruction Tuning
Remote RLHF Evaluation Specialist — Instruction Tuning

AI Trainer Jobs • United States

Remote
USD 28,000 - 48,000
Remote Voice QA Evaluator — Model Output Feedback
Remote Voice QA Evaluator — Model Output Feedback

AI Trainer Jobs • United States

Remote
USD 57,000 - 81,000
Remote Low-Resource Language AI Evaluator & Feedback Pro
Remote Low-Resource Language AI Evaluator & Feedback Pro

AI Trainer Jobs • United States

Remote
USD 28,000 - 41,000