AI Evaluation Specialist - Remote

YO AI Labs

New York (NY)

Remote

USD 34,000 - 55,000

Full time

13 days ago
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Job summary

YO AI Labs is seeking experienced AI Evaluation Specialists to assess and improve the quality of AI assistant outputs for an enterprise training project. This contractor role is remote and open to workers in the US, Canada, UK, Ireland, Australia, and New Zealand.

You will evaluate AI-generated responses against rubrics for accuracy, relevance, and adherence to guidelines, provide actionable feedback, and help evolve evaluation standards and processes while documenting findings for the team.

Qualifications

  • Experience in grading, QA, editorial review, assessment, annotation, or similar analytical work.
  • Advanced, daily use of AI assistants such as ChatGPT or Claude.
  • Strong ability to analyze complex information and communicate findings in writing.

Responsibilities

  • Evaluate AI outputs against rubrics for accuracy and relevance.
  • Apply consistent, objective judgment across large volumes.
  • Identify reasoning gaps, tool-use issues, and inconsistencies.
  • Provide concise, actionable feedback.
  • Participate in rubric interpretation discussions.
  • Contribute to process improvements and best practices.
  • Maintain documentation of evaluations and recommendations.

Skills

Quality assurance
Editorial review
Analytical work
High-volume evaluation
Independent work
Attention to detail
Critical thinking
Collaboration

Tools

ChatGPT
Claude

Job description

AI Evaluation Specialist

Role Type: Contractor
Location: Remote — US, Canada, UK, Ireland, Australia, New Zealand

We are seeking experienced AI Evaluation Specialists to assess and improve the quality of AI assistant outputs for an enterprise AI training project.

You'll evaluate AI-generated responses using defined quality standards, identify issues, and provide clear feedback to help improve AI systems. No prior formal AI experience is required.

Scope of Work
  • Evaluate AI-generated outputs against detailed rubrics for accuracy, relevance, quality, and adherence to guidelines.
  • Apply consistent and objective judgment across large volumes of examples.
  • Identify reasoning gaps, tool-use issues, logical errors, and inconsistencies.
  • Provide concise, actionable feedback highlighting strengths and areas for improvement.
  • Participate in discussions around rubric interpretation and evolving quality standards.
  • Contribute to process improvements and evaluation best practices.
  • Maintain accurate documentation of evaluations and recommendations.
Preferred Qualifications
  • Experience in grading, quality assurance, editorial review, assessment, annotation, or similar analytical work.
  • Advanced, daily use of AI assistants such as ChatGPT, Claude, or similar tools.
  • Strong ability to analyze complex information and communicate findings clearly in writing.
  • Experience with process improvement, rubric development, or quality assessment.
  • Strong critical-thinking skills with a focus on consistency, accuracy, and fairness.
  • Comfortable working independently on high-volume evaluation tasks.
  • Strong attention to detail and ability to identify subtle quality issues.
  • Collaborative approach to resolving ambiguous cases and improving evaluation criteria.
Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

AI Evaluation Expert - Remote
AI Evaluation Expert - Remote

YO AI Labs • New York (NY)

Remote
USD 34,000 - 76,000
AI Evaluation Specialist
AI Evaluation Specialist

micro1 • United States

On-site
AUD 70,000 - 110,000
Remote AI Quality Evaluator (Contractor)
Remote AI Quality Evaluator (Contractor)

YO AI Labs • New York (NY)

Remote
USD 34,000 - 55,000
AI Evaluation Expert — Remote Quality & Feedback
AI Evaluation Expert — Remote Quality & Feedback

YO AI Labs • New York (NY)

Remote
USD 34,000 - 76,000
AI Evaluation Specialist
AI Evaluation Specialist

Weekday 1 • United States

Remote
USD 80,000 - 113,000
AI Quality Assurance & Evaluation Specialist
AI Quality Assurance & Evaluation Specialist

Gramian Consulting Group • United States

Remote
USD 28,000 - 55,000
AI Evaluation Specialist - Remote Contract
AI Evaluation Specialist - Remote Contract

micro1 • United States

Remote
AUD 70,000 - 110,000
Quality Specialist(AI) | $40/hr Remote
Quality Specialist(AI) | $40/hr Remote

Crossing Hurdles • United States

On-site
GBP 30,924 - 41,233
Educator/ Assessor Writer - Remote
Educator/ Assessor Writer - Remote

YO AI Labs • New York (NY)

Remote
USD 34,000 - 76,000
Technology AI Evaluation Expert
Technology AI Evaluation Expert

Weekday 1 • United States

Remote
USD 21,000 - 28,000
Fully remote
Flexible hours
Weekly payments