Remote AI Evaluation & Calibration Specialist

Crossing Hurdles

Philippines

On-site

PHP 279,000 - 502,200

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Crossing Hurdles seeks meticulous contributors to craft and evaluate AI conversation drafts. You will write detailed, task-based conversations, align rubrics with project specs, and iteratively refine outputs against frontier language models.

Applicants should have native-level English, experience in data annotation or AI evaluation, and strong analytical skills. You will work independently, delivering quality transcripts and evidence while adhering to evolving guidelines.

Qualifications

  • Native-level written English with exceptional clarity, structure and attention to detail.
  • Experience in data annotation, RLHF, SFT, evaluation, or prompt engineering for AI systems.
  • Knowledge of frontier LLM behaviors and common model failure patterns.
  • Ability to interpret and apply highly detailed specifications without supervision.
  • Strong critical thinking and analytical skills in writing-heavy or analysis-heavy domains.

Responsibilities

  • Author detailed, task-based multi-turn conversations and rubrics aligned with project specifications.
  • Test and refine conversation drafts against frontier large language models, iterating to meet quality and difficulty requirements.
  • Deliver comprehensive evaluation assets including transcripts, target behaviors, binary rubrics, and supporting evidence.
  • Ensure strict fidelity to evolving project specs while maintaining high throughput and attention to detail.
  • Validate and calibrate outputs with team leads and quality control as guidelines change.
  • Work independently and consistently, meeting expected output rates for deliverable completion.

Skills

Native English writing
Data annotation
RLHF evaluation
Analytical thinking

Job description

Crossing Hurdles seeks meticulous contributors to craft and evaluate AI conversation drafts. You will write detailed, task-based conversations, align rubrics with project specs, and iteratively refine outputs against frontier language models.

Applicants should have native-level English, experience in data annotation or AI evaluation, and strong analytical skills. You will work independently, delivering quality transcripts and evidence while adhering to evolving guidelines.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Remote AI Evaluation Specialist & Rubric Designer
Remote AI Evaluation Specialist & Rubric Designer

Crossing Hurdles • Philippines

On-site
AI Evaluator | $30/hr Remote
AI Evaluator | $30/hr Remote

Crossing Hurdles • Philippines

On-site
AI Quality Assurance Specialist | $30/hr Remote
AI Quality Assurance Specialist | $30/hr Remote

Crossing Hurdles • Philippines

On-site
PHP 180,000 - 320,000
AI QA Specialist for Frontier LLMs
AI QA Specialist for Frontier LLMs

Crossing Hurdles • Philippines

On-site
PHP 180,000 - 320,000
Remote AI Language Quality Specialist
Remote AI Language Quality Specialist

YO IT Consulting • Philippines

On-site
Remote Conversation Quality Analyst for AI Training
Remote Conversation Quality Analyst for AI Training

Alignerr • Philippines

On-site
PHP 678,000 - 1,356,000
AI Evaluation Specialist | $35/hr Remote
AI Evaluation Specialist | $35/hr Remote

Crossing Hurdles • Philippines

On-site
Remote AI Content Quality Evaluator
Remote AI Content Quality Evaluator

Alignerr • Philippines

On-site
PHP 1,017,000 - 1,696,000
AI Content Evaluator (Remote)
AI Content Evaluator (Remote)

Innodata Inc. • Philippines

On-site
PHP 240,000 - 360,000
Remote AI Training & Evaluation Specialist
Remote AI Training & Evaluation Specialist

Alignerr • Philippines

On-site
PHP 424,000 - 763,000
Fully remote
Flexible hours