AI Evaluation Specialist - Remote

YO AI Labs

Ciudad de Mendoza

A distancia

ARS 91.155.000 - 136.732.000

Jornada completa

Hace 2 días
Sé de los primeros/as/es en solicitar esta vacante
Generador de candidaturas

A complete application in a minute — tailored resume and cover letter, ready to send.

Supera los filtros ATS

Descripción de la vacante

YO AI Labs is seeking an experienced AI Evaluation Specialist to assess and improve the quality of AI assistant outputs for an enterprise training project. This contractor role is remote worldwide, with focus on evaluating responses against rubrics and providing actionable feedback.

You will identify gaps, inconsistencies, and tool-use issues, contribute to rubric development, and document evaluations. Candidates should be capable of working independently on high-volume tasks and communicating

Formación

  • Experience in grading, QA, editorial review, assessment, annotation, or similar analytical work.
  • Advanced daily use of AI assistants such as ChatGPT, Claude, or similar tools.
  • Strong ability to analyze complex information and communicate findings clearly in writing.
  • Experience with process improvement, rubric development, or quality assessment.
  • Strong critical-thinking skills with a focus on consistency, accuracy, and fairness.
  • Comfortable working independently on high-volume evaluation tasks.
  • Strong attention to detail and ability to identify subtle quality issues.
  • Collaborative approach to resolving ambiguous cases and improving evaluation criteria.

Responsabilidades

  • Evaluate AI-generated outputs against rubrics for accuracy, relevance, quality, and adherence to guidelines.
  • Apply consistent and objective judgment across large volumes of examples.
  • Identify reasoning gaps, tool-use issues, logical errors, and inconsistencies.
  • Provide concise, actionable feedback highlighting strengths and areas for improvement.
  • Participate in discussions around rubric interpretation and evolving quality standards.
  • Contribute to process improvements and evaluation best practices.
  • Maintain accurate documentation of evaluations and recommendations.

Conocimientos

Grading/QA/Editorial review
AI assistant tools (ChatGPT/Claude)
Analytical writing
Process improvement / rubric
Critical thinking
Independent evaluation (high-volume)
Attention to detail
Collaborative rubric development

Herramientas

ChatGPT
Claude

Descripción del empleo

AI Evaluation Specialist

Role Type: Contractor
Location: Remote — US, Canada, UK, Ireland, Australia, New Zealand

We are seeking experienced AI Evaluation Specialists to assess and improve the quality of AI assistant outputs for an enterprise AI training project.

You'll evaluate AI-generated responses using defined quality standards, identify issues, and provide clear feedback to help improve AI systems. No prior formal AI experience is required.

Scope of Work
  • Evaluate AI-generated outputs against detailed rubrics for accuracy, relevance, quality, and adherence to guidelines.
  • Apply consistent and objective judgment across large volumes of examples.
  • Identify reasoning gaps, tool-use issues, logical errors, and inconsistencies.
  • Provide concise, actionable feedback highlighting strengths and areas for improvement.
  • Participate in discussions around rubric interpretation and evolving quality standards.
  • Contribute to process improvements and evaluation best practices.
  • Maintain accurate documentation of evaluations and recommendations.
Preferred Qualifications
  • Experience in grading, quality assurance, editorial review, assessment, annotation, or similar analytical work.
  • Advanced, daily use of AI assistants such as ChatGPT, Claude, or similar tools.
  • Strong ability to analyze complex information and communicate findings clearly in writing.
  • Experience with process improvement, rubric development, or quality assessment.
  • Strong critical-thinking skills with a focus on consistency, accuracy, and fairness.
  • Comfortable working independently on high-volume evaluation tasks.
  • Strong attention to detail and ability to identify subtle quality issues.
  • Collaborative approach to resolving ambiguous cases and improving evaluation criteria.
Consigue la evaluación confidencial y gratuita de tu currículum.

o arrastra y suelta tu archivo aquí

Similar jobs

Puestos de trabajo similares que vale la pena comparar

AI Evaluation Specialist - Remote
AI Evaluation Specialist - Remote

YO AI Labs • Buenos Aires

A distancia
ARS 41.858.000 - 83.717.000
AI Evaluation Expert - Remote
AI Evaluation Expert - Remote

YO AI Labs • Ciudad de Mendoza

A distancia
ARS 83.775.000 - 125.663.000
AI Quality Evaluator (Remote Contractor)
AI Quality Evaluator (Remote Contractor)

YO AI Labs • Ciudad de Mendoza

A distancia
ARS 83.775.000 - 125.663.000
AI Quality Evaluator — Remote
AI Quality Evaluator — Remote

YO AI Labs • Buenos Aires

A distancia
ARS 106.422.000 - 152.031.000
Remote AI Evaluation Specialist — Quality Feedback Pro
Remote AI Evaluation Specialist — Quality Feedback Pro

YO AI Labs • Buenos Aires

A distancia
ARS 41.858.000 - 83.717.000
AI Agent Power User - Remote
AI Agent Power User - Remote

YO AI Labs • Buenos Aires

A distancia
ARS 83.717.000 - 146.504.000
AI Agent Power User - Remote
AI Agent Power User - Remote

YO AI Labs • Ciudad de Mendoza

A distancia
ARS 125.575.000 - 209.292.000
AI Quality Evaluator (Remote) – Feedback & Rubrics
AI Quality Evaluator (Remote) – Feedback & Rubrics

YO AI Labs • Ciudad de Mendoza

A distancia
ARS 91.155.000 - 136.732.000
Remote Ai Agent Engineer: Genai, Rag & Api Pipelines
Remote Ai Agent Engineer: Genai, Rag & Api Pipelines

Neura Market • Neuquén

A distancia
ARS 91.155.000 - 136.732.000
Product Manager - Remote
Product Manager - Remote

YO AI Labs • Buenos Aires

A distancia
ARS 1.000.000 - 2.000.000