Remote Visual AI Evaluation Specialist

AuraOne

United States

Remote

USD 41,000 - 55,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

AuraOne is seeking an Image Reasoning Generalist — Visual AI Evaluation contractor to review model outputs against a standard rubric. This remote, US-eligible role focuses on labeling edge cases, writing structured feedback, and helping retrain the system.

You will compare paired outputs, tag issues, and calibrate against gold-standard examples, committing to at least 10 hours per week. Compensation is $35 per hour.

Qualifications

  • Prior evaluation, annotation, or human-rater experience on image reasoning generalist evaluation or adjacent content.
  • Comfort applying multi-page rubrics consistently across long batches.
  • Clear written reasoning that names the issue and the rubric clause being applied.
  • Strong attention to detail and the ability to flag when a prompt itself is the problem.
  • Reliable async availability for at least 10 hours per week.

Responsibilities

  • Evaluate image reasoning generalist evaluation model outputs against a versioned rubric and assign severity tags for Image Reasoning Generalist — Visual AI Evaluation (Remote, $35/hr) assignments.
  • Compare paired responses and pick the stronger answer with a written rationale.
  • Label hallucinations, instruction-following failures, and unsafe content with structured tags.
  • Capture ambiguous prompts and route them back to the program team for rubric updates.
  • Maintain reviewer-quality scores by calibrating against gold-standard examples each week.
  • Document recurring failure modes so the modeling team can target them in the next training run.

Skills

Model output evaluation
Rubric-based annotation
Severity tagging
Inter-rater calibration
Image Reasoning Generalist evaluation

Job description

AuraOne is seeking an Image Reasoning Generalist — Visual AI Evaluation contractor to review model outputs against a standard rubric. This remote, US-eligible role focuses on labeling edge cases, writing structured feedback, and helping retrain the system.

You will compare paired outputs, tag issues, and calibrate against gold-standard examples, committing to at least 10 hours per week. Compensation is $35 per hour.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Remote AI Evaluation & Feedback Specialist
Remote AI Evaluation & Feedback Specialist

AuraOne • United States

On-site
USD 55,000 - 110,000
Remote work
US-eligible
Contractor position
Remote Computer Vision & Spatial Reasoning Evaluator
Remote Computer Vision & Spatial Reasoning Evaluator

AuraOne • United States

On-site
USD 41,000 - 69,000
Remote Mobile AI Evaluation Specialist
Remote Mobile AI Evaluation Specialist

AuraOne • United States

On-site
USD 34,000 - 69,000
Remote Video Understanding Evaluator & Rubric Auditor
Remote Video Understanding Evaluator & Rubric Auditor

AuraOne • United States

On-site
USD 41,000 - 69,000
Remote work
Remote AI Model Evaluation & Rubric Specialist
Remote AI Model Evaluation & Rubric Specialist

AuraOne • United States

Remote
Remote AI Evaluation & Annotation Specialist (Contractor)
Remote AI Evaluation & Annotation Specialist (Contractor)

AuraOne • United States

On-site
USD 34,000 - 55,000
Remote AI Evaluation Rubric Reviewer
Remote AI Evaluation Rubric Reviewer

AuraOne • United States

On-site
USD 34,000 - 69,000
Remote AI Workflow Evaluator – Management Consultant
Remote AI Workflow Evaluator – Management Consultant

AuraOne • United States

On-site
USD 34,000 - 83,000
Remote AI Research & Citation Evaluator
Remote AI Research & Citation Evaluator

AuraOne • United States

On-site
USD 28,000 - 50,000
Remote Computer Vision Evaluation & Annotation Specialist
Remote Computer Vision Evaluation & Annotation Specialist

AuraOne • United States

On-site
USD 28,000 - 55,000