Arabic Evaluation Specialist - Model Feedback (Remote)

AI Trainer Jobs

United States

Remote

USD 22,000 - 25,000

Full time

2 days ago
Be an early applicant
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Job summary

AuraOne seeks an Arabic expert for a remote evaluation track to review Arabic generalist prompts and responses against our quality rubric. Reviewers compare paired outputs, tag edge cases, and write structured feedback for retraining.

As a contractor, you will help turn outputs into auditable labels, rationales, and regression cases, calibrate ratings against gold standards weekly, and participate in rubric updates. Reliable async availability for at least 10 hours per week is required.

Qualifications

  • Prior evaluation, annotation, or human-rater experience on arabic generalist evaluation or adjacent content.
  • Comfort applying multi-page rubrics consistently across long batches.
  • Clear written reasoning that names the issue and the rubric clause being applied.
  • Reliable async availability for at least 10 hours per week.

Responsibilities

  • Evaluate arabic generalist evaluation model outputs against a versioned rubric and assign severity tags for Arabic expert assignments.
  • Compare paired responses and pick the stronger answer with a written rationale.
  • Label hallucinations, instruction-following failures, and unsafe content with structured tags.
  • Capture ambiguous prompts and route them back to the program team for rubric updates.
  • Maintain reviewer-quality scores by calibrating against gold-standard examples each week.

Skills

Arabic generalist evaluation
Inter-rater calibration
Severity tagging
Model output evaluation
Rubric-based annotation

Job description

AuraOne seeks an Arabic expert for a remote evaluation track to review Arabic generalist prompts and responses against our quality rubric. Reviewers compare paired outputs, tag edge cases, and write structured feedback for retraining.

As a contractor, you will help turn outputs into auditable labels, rationales, and regression cases, calibrate ratings against gold standards weekly, and participate in rubric updates. Reliable async availability for at least 10 hours per week is required.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Arabic Language Evaluation Specialist — Remote
Arabic Language Evaluation Specialist — Remote

AI Trainer Jobs • United States

Remote
USD 34,000 - 69,000
Remote Arabic Localization & Cultural Context Evaluator
Remote Arabic Localization & Cultural Context Evaluator

AI Trainer Jobs • United States

Remote
USD 28,000 - 48,000
Remote
Remote Bilingual Arabic Evaluator (Egypt)
Remote Bilingual Arabic Evaluator (Egypt)

AI Trainer Jobs • United States

Remote
USD 39,000 - 44,000
Arabic Audio Evaluation Specialist (Remote)
Arabic Audio Evaluation Specialist (Remote)

AI Trainer Jobs • United States

Remote
USD 62,000 - 76,000
Remote work
US-eligible contractor
Arabic Music Audio Evaluator — Remote Quality Reviewer
Arabic Music Audio Evaluator — Remote Quality Reviewer

AI Trainer Jobs • United States

Remote
USD 17,000 - 61,000
Arabic expert
Arabic expert

AI Trainer Jobs • United States

Remote
USD 22,000 - 25,000
Remote Arabic QA Specialist - MCQA Reviewer
Remote Arabic QA Specialist - MCQA Reviewer

AI Trainer Jobs • United States

Remote
USD 33,000 - 41,000
Arabic Language Expert
Arabic Language Expert

AI Trainer Jobs • United States

Remote
USD 34,000 - 69,000
Arabic Audio Recording Expert
Arabic Audio Recording Expert

AI Trainer Jobs • United States

Remote
USD 62,000 - 76,000
Remote work
US-eligible contractor
Bilingual Writer - Arabic (Egypt)
Bilingual Writer - Arabic (Egypt)

AI Trainer Jobs • United States

Remote
USD 39,000 - 44,000