Remote Bilingual Model Evaluation Specialist

AI Trainer Jobs

United States

Remote

USD 68,000 - 135,000

Part time

2 days ago
Be an early applicant
Application generator

Don’t send a generic resume — generate a resume and cover letter tailored to this exact role.

Get past ATS filters

Job summary

AuraOne is seeking evaluators to remotely review bilingual generalists prompts and responses, scoring them against a versioned rubric. You will compare paired outputs, label edge cases, and draft structured feedback for retraining the modeling team.

Responsibilities include identifying hallucinations, instruction-following failures, and unsafe content with precise tags, while maintaining calibration against gold standards and ensuring consistent rubric application.

Qualifications

  • Prior evaluation, annotation, or human-rater experience on bilingual generalists evaluation or adjacent content.
  • Clear written reasoning naming the issue and the rubric clause applied.
  • Reliable async availability for at least 10 hours per week.

Responsibilities

  • Evaluate model outputs against a versioned rubric and assign severity tags.
  • Compare paired responses and select the stronger answer with rationale.
  • Label hallucinations and policy violations with structured tags.
  • Capture ambiguous prompts and coordinate rubric updates with the team.
  • Calibrate reviewer quality against gold-standard examples weekly.

Skills

Attention to detail
Written reasoning
Async availability
Bilingual proficiency

Education

Linguistics background

Tools

Annotation tools

Job description

AuraOne is seeking evaluators to remotely review bilingual generalists prompts and responses, scoring them against a versioned rubric. You will compare paired outputs, label edge cases, and draft structured feedback for retraining the modeling team.

Responsibilities include identifying hallucinations, instruction-following failures, and unsafe content with precise tags, while maintaining calibration against gold standards and ensuring consistent rubric application.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Remote Bilingual AI Evaluation Specialist
Remote Bilingual AI Evaluation Specialist

AI Trainer Jobs • United States

Remote
USD 34,000 - 55,000
Remote English Language Evaluation & QA Specialist
Remote English Language Evaluation & QA Specialist

AI Trainer Jobs • United States

Remote
USD 34,000 - 55,000
Remote work
Contractor role
Remote Spanish Model Evaluation Specialist
Remote Spanish Model Evaluation Specialist

AuraOne • United States

On-site
USD 41,000 - 58,000
Remote Spanish Evaluation Specialist
Remote Spanish Evaluation Specialist

AuraOne • United States

On-site
USD 137,760,000 - 151,536,000
Remote Spanish Linguistic Evaluator & Rubric Calibrator
Remote Spanish Linguistic Evaluator & Rubric Calibrator

AI Trainer Jobs • United States

Remote
USD 55,000 - 83,000
Remote Russian–English Model Evaluation Specialist
Remote Russian–English Model Evaluation Specialist

AI Trainer Jobs • United States

Remote
USD 34,000 - 55,000
Latin Bilingual Evaluator & Model Feedback Specialist
Latin Bilingual Evaluator & Model Feedback Specialist

AI Trainer Jobs • United States

Remote
USD 30,000 - 47,000
Remote Bilingual Japanese AI Evaluation Specialist
Remote Bilingual Japanese AI Evaluation Specialist

AI Trainer Jobs • United States

Remote
USD 68,000 - 135,000
Remote English Evaluation & Feedback Specialist
Remote English Evaluation & Feedback Specialist

AI Trainer Jobs • United States

Remote
USD 83,000 - 138,000
Remote Frontier Model Evaluation Specialist
Remote Frontier Model Evaluation Specialist

AI Trainer Jobs • United States

Remote
USD 28,000 - 55,000