AI Evaluation Specialist - Remote

YO AI Labs

Toronto

Remote

CAD 34,000 - 69,000

Part time

22 hours ago
Be an early applicant
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Job summary

YO AI Labs in Toronto, Canada, is seeking an AI Evaluation Specialist as a contractor to assess enterprise AI training outputs and improve evaluation quality. You will rate AI responses against rubrics, identify issues, and provide actionable feedback to refine systems.

Ideal candidates have experience in QA, annotation, or editorial review and daily use of AI assistants like ChatGPT or Claude, with strong analytical writing and attention to detail.

Qualifications

  • Experience in grading, QA, editorial review, or similar analytical work.
  • Daily use of AI assistants such as ChatGPT, Claude, or similar tools.
  • Strong ability to analyze complex information and communicate findings in writing.
  • Experience with process improvement, rubric development, or quality assessment.
  • Attention to detail and fairness in evaluation.

Responsibilities

  • Evaluate AI-generated outputs against rubrics for accuracy, relevance, quality, and guidelines.
  • Apply consistent and objective judgment across large volumes of examples.
  • Identify reasoning gaps, tool-use issues, and inconsistencies.
  • Provide concise, actionable feedback to improve AI systems.
  • Maintain accurate documentation of evaluations and recommendations.
  • Participate in rubric interpretation discussions and evolving quality standards.

Skills

Quality assurance
Annotation
Editorial review
Process improvement
Analytical writing
Independent work

Tools

ChatGPT
Claude

Job description

AI Evaluation Specialist

Role Type: Contractor
Location: Remote — US, Canada, UK, Ireland, Australia, New Zealand

We are seeking experienced AI Evaluation Specialists to assess and improve the quality of AI assistant outputs for an enterprise AI training project.

You'll evaluate AI-generated responses using defined quality standards, identify issues, and provide clear feedback to help improve AI systems. No prior formal AI experience is required.

Scope of Work
  • Evaluate AI-generated outputs against detailed rubrics for accuracy, relevance, quality, and adherence to guidelines.
  • Apply consistent and objective judgment across large volumes of examples.
  • Identify reasoning gaps, tool-use issues, logical errors, and inconsistencies.
  • Provide concise, actionable feedback highlighting strengths and areas for improvement.
  • Participate in discussions around rubric interpretation and evolving quality standards.
  • Contribute to process improvements and evaluation best practices.
  • Maintain accurate documentation of evaluations and recommendations.
Preferred Qualifications
  • Experience in grading, quality assurance, editorial review, assessment, annotation, or similar analytical work.
  • Advanced, daily use of AI assistants such as ChatGPT, Claude, or similar tools.
  • Strong ability to analyze complex information and communicate findings clearly in writing.
  • Experience with process improvement, rubric development, or quality assessment.
  • Strong critical-thinking skills with a focus on consistency, accuracy, and fairness.
  • Comfortable working independently on high-volume evaluation tasks.
  • Strong attention to detail and ability to identify subtle quality issues.
  • Collaborative approach to resolving ambiguous cases and improving evaluation criteria.
Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

AI Evaluation Specialist - Remote
AI Evaluation Specialist - Remote

YO AI Labs • Montreal (administrative region)

Remote
CAD 41,000 - 76,000
AI Evaluation Specialist - Remote
AI Evaluation Specialist - Remote

YO AI Labs • Ottawa

Remote
CAD 42,000 - 68,000
AI Agent Power User - Remote
AI Agent Power User - Remote

YO AI Labs • Toronto

Remote
CAD 93,000 - 171,000
AI Agent Power User - Remote
AI Agent Power User - Remote

YO AI Labs • Montreal (administrative region)

Remote
CAD 83,000 - 124,000
AI Agent Power User - Remote
AI Agent Power User - Remote

YO AI Labs • Ottawa

Remote
CAD 111,000 - 166,000
Remote AI Evaluation Specialist: Quality Feedback
Remote AI Evaluation Specialist: Quality Feedback

YO AI Labs • Ottawa

Remote
CAD 42,000 - 68,000
AI Evaluation Specialist | Remote
AI Evaluation Specialist | Remote

Crossing Hurdles • Canada

On-site
CAD 40,000 - 60,000
Remote AI Quality Evaluator – Contractor
Remote AI Quality Evaluator – Contractor

YO AI Labs • Montreal (administrative region)

Remote
CAD 41,000 - 76,000
Technical Writer - Remote
Technical Writer - Remote

YO AI Labs • Montreal (administrative region)

Remote
CAD 60,000 - 90,000
Personalized AI Response Evaluator
Personalized AI Response Evaluator

OpenTrain AI • Canada

On-site
CAD 28,000 - 41,000