AI Dialogue & Interaction Evaluator (Remote)

AuraOne

United States

On-site

USD 25,000 - 44,000

Part time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

AuraOne is seeking an AI Agent Interaction Specialist to review prompts and model outputs against our quality rubric in a remote contractor role. You will compare paired responses, label edge cases, and provide structured feedback to retrain the model effectively.

Responsibilities include documenting recurring failure modes, calibrating against gold-standard examples weekly, and ensuring high-quality annotations. Reliable async availability for at least 10 hours per week is expected.

Qualifications

  • Prior evaluation, annotation, or human-rater experience in AI agent interaction evaluation or related content.
  • Comfort applying multi-page rubrics consistently across long batches.
  • Clear written reasoning that names the issue and rubric clause.
  • Strong attention to detail and ability to flag when a prompt is the problem.
  • Reliable async availability for at least 10 hours per week.

Responsibilities

  • Evaluate AI agent interaction evaluation model outputs against a versioned rubric and assign severity tags.
  • Compare paired responses and select the stronger answer with written rationale.
  • Label hallucinations, instruction-following failures, and unsafe content with structured tags.
  • Capture ambiguous prompts and route to program team for rubric updates.
  • Maintain reviewer-quality scores by calibrating against gold-standard examples.
  • Document recurring failure modes for the modeling team to address in training.

Skills

Attention to detail
Rubric-based annotation
Inter-rater calibration
Written reasoning
Async availability

Job description

AuraOne is seeking an AI Agent Interaction Specialist to review prompts and model outputs against our quality rubric in a remote contractor role. You will compare paired responses, label edge cases, and provide structured feedback to retrain the model effectively.

Responsibilities include documenting recurring failure modes, calibrating against gold-standard examples weekly, and ensuring high-quality annotations. Reliable async availability for at least 10 hours per week is expected.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Remote AI Evaluation & Feedback Specialist
Remote AI Evaluation & Feedback Specialist

AuraOne • United States

On-site
USD 55,000 - 110,000
Remote work
US-eligible
Contractor position
Remote AI Evaluation & Annotation Specialist (Contractor)
Remote AI Evaluation & Annotation Specialist (Contractor)

AuraOne • United States

On-site
USD 34,000 - 55,000
Remote Mobile AI Evaluation Specialist
Remote Mobile AI Evaluation Specialist

AuraOne • United States

On-site
USD 34,000 - 69,000
Remote Conversational AI Evaluator - Rubric QA & Feedback
Remote Conversational AI Evaluator - Rubric QA & Feedback

AuraOne • United States

On-site
USD 28,000 - 55,000
Remote AI Evaluation Specialist — Business Operations Feedback
Remote AI Evaluation Specialist — Business Operations Feedback

AuraOne • United States

On-site
USD 34,000 - 69,000
Remote AI Language Evaluator & Quality Auditor
Remote AI Language Evaluator & Quality Auditor

AuraOne • United States

On-site
USD 28,000 - 55,000
Remote Bilingual AI Evaluation Specialist
Remote Bilingual AI Evaluation Specialist

AuraOne • United States

On-site
USD 28,000 - 48,000
Remote AI Evaluation & Rubric Reviewer
Remote AI Evaluation & Rubric Reviewer

AuraOne • United States

On-site
USD 34,000 - 55,000
Remote AI Workflow Evaluator – Management Consultant
Remote AI Workflow Evaluator – Management Consultant

AuraOne • United States

On-site
USD 34,000 - 83,000
Remote Chemical Eng AI Evaluator & Feedback Specialist
Remote Chemical Eng AI Evaluator & Feedback Specialist

AuraOne • United States

On-site
USD 34,000 - 55,000
Remote work
Flexible schedule
Contractor engagement