STEM Careers Canada

Rex.zone

United States

Remote

USD 41,328 - 68,880

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

A tech company specializing in AI solutions is searching for a remote, full-time candidate to support AI/ML training workflows. In this role, you will perform high-accuracy data labeling, execute RLHF evaluation, and ensure training data quality. Candidates should have mid-senior experience in evaluation or data annotation, familiarity with NLP concepts, and strong communication skills. Compensation ranges from $30 to $50 per hour depending on experience.

Qualifications

  • Mid-Senior experience in evaluation or annotation programs.
  • Strong consistency applying detailed rubrics with low error rates.
  • Familiarity with LLM training pipelines and preference-based grading.

Responsibilities

  • Perform high-accuracy data labeling for text, image, and multimodal datasets.
  • Execute RLHF evaluation and rubric-based scoring.
  • Maintain annotation guidelines compliance.

Skills

Evaluation experience
Data annotation
Attention to detail
NLP knowledge

Job description

About The Role

This remote, full-time role supports AI/ML training workflows through high-quality data labeling, RLHF-style preference ranking, prompt evaluation, and QA evaluation. You will apply clear rubrics and annotation guidelines to improve training data quality and measurable model performance.

Key Responsibilities
  • Perform high-accuracy data labeling for text, image, and multimodal datasets
  • Execute RLHF evaluation (preference comparisons, rubric-based scoring)
  • Run prompt evaluation and response grading for LLM evaluation
  • Apply content safety labeling and policy-aware categorization
  • Maintain annotation guidelines compliance and propose guideline improvements
  • Conduct QA evaluation, audits, and disagreement resolution to ensure training data quality
  • Document edge cases clearly and support distributed, asynchronous collaboration
Required Qualifications
  • Mid-Senior experience in evaluation, annotation programs, or engineering-adjacent data operations
  • Strong consistency applying detailed rubrics with low error rates
  • Familiarity with LLM training pipelines and preference-based grading (RLHF)
  • Working knowledge of NLP concepts (e.g., named entity recognition)
  • Exposure to computer vision annotation workflows preferred
  • Strong written communication for QA notes and edge-case documentation
Compensation

Competitive base pay: $30–$50 per hour.

Remote, full-time; async-first collaboration.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Remote AI Jobs Canada
Remote AI Jobs Canada

Rex.zone • United States

On-site
Online STEM Engineer (Canada)
Online STEM Engineer (Canada)

Rex.zone • United States

On-site
USD 80,000 - 110,000
Entry Level STEM Jobs United States
Entry Level STEM Jobs United States

Rex.zone • United States

Remote
AI Jobs in India — Remote AI Data Annotation Specialist
AI Jobs in India — Remote AI Data Annotation Specialist

Rex.zone • United States

On-site
STEM Degree Jobs in Canada
STEM Degree Jobs in Canada

Rex.zone • United States

On-site
USD 80,000 - 120,000
AI Data Labeling Jobs Canada
AI Data Labeling Jobs Canada

Rex.zone • United States

Remote
USD 41,000 - 69,000
Remote work
Asynchronous collaboration
Remote STEM Engineer (United States)
Remote STEM Engineer (United States)

Rex.zone • United States

On-site
STEM Degree Jobs in the United States (Remote AI/ML Engineering Role)
STEM Degree Jobs in the United States (Remote AI/ML Engineering Role)

Rex.zone • United States

Remote
STEM Jobs in Canada — Remote Full-Time Engineer
STEM Jobs in Canada — Remote Full-Time Engineer

Rex.zone • United States

Remote
USD 80,000 - 120,000
STEM Careers in the United States
STEM Careers in the United States

Rex.zone • United States

Remote