Remote AI Quality Evaluator & Support for LLM Benchmarking

Innodata Inc.

Argentina

Presencial

ARS 29.181.000 - 52.109.000

Jornada completa

Hace 9 días
Generador de candidaturas

Consigue una respuesta de este empleador — un currículum y una carta de presentación adaptados exactamente a lo que busca para contratar.

Supera los filtros ATS

Descripción de la vacante

Innodata is seeking detail-oriented evaluators to conduct human quality evaluations for an enterprise AI customer support product across social media platforms. You will evaluate and benchmark AI model responses against complex rubrics using provided knowledge bases.

Hourly commitment is 6 hours per day. This freelance, remote role is for 2 months with potential extension, ideal for candidates with strong English, customer service experience, and meticulous attention to guidelines.

Formación

  • Experience in customer service, call centers, retail, or customer communications.
  • Excellent English proficiency with strong grammar, tone, and comprehension.
  • Strong analytical and attention-to-detail skills.
  • Ability to follow complex guidelines consistently.
  • Comfortable working with web-based evaluation and labeling tools.

Responsabilidades

  • Evaluate AI-generated customer interactions using defined quality parameters.
  • Verify AI responses against FAQs, product catalogs, SOPs, and other approved sources.
  • Participate in dual reviews and daily calibration to maintain evaluation consistency.
  • Follow detailed rubrics and logic trees while meeting productivity targets.
  • Maintain an average handling time of approximately 45 minutes per job.

Conocimientos

Customer service
Analytical skills
Attention to detail
Following guidelines
English proficiency

Herramientas

Web-based evaluation tools

Descripción del empleo

Innodata is seeking detail-oriented evaluators to conduct human quality evaluations for an enterprise AI customer support product across social media platforms. You will evaluate and benchmark AI model responses against complex rubrics using provided knowledge bases.

Hourly commitment is 6 hours per day. This freelance, remote role is for 2 months with potential extension, ideal for candidates with strong English, customer service experience, and meticulous attention to guidelines.

Consigue la evaluación confidencial y gratuita de tu currículum.
o arrastra y suelta tu archivo aquí
Similar jobs

Puestos de trabajo similares que vale la pena comparar

Content Evaluator – Customer Support & LLM Benchmarking
Content Evaluator – Customer Support & LLM Benchmarking

Innodata Inc. • Argentina

Presencial
ARS 29.181.000 - 52.109.000
Remote Native-Language AI Benchmark Engineer
Remote Native-Language AI Benchmark Engineer

Lilt • Argentina

A distancia
ARS 124.818.000 - 249.637.000
Remote work
Flexible schedule
Prompt payments
Remote AI Copywriter & Content QA Specialist
Remote AI Copywriter & Content QA Specialist

YO IT Consulting • Argentina

A distancia
ARS 1.653.000 - 3.720.000
LLM Evaluation Scientist: Frontier Benchmarking
LLM Evaluation Scientist: Frontier Benchmarking

Anyone AI • Buenos Aires

Presencial
ARS 178.909.000 - 268.365.000
AI Quality Engineer
AI Quality Engineer

Moveo Technologies Corp - drvn • Rosario

Presencial
ARS 1.200.000 - 2.400.000
Remote Marketing Educator for AI Training (Flexible)
Remote Marketing Educator for AI Training (Flexible)

Alignerr • Municipio de Rincón de los Sauces

Presencial
ARS 827.000 - 1.653.000
Fully remote
Flexible schedule
Contract-based
+1
Remote AI Annotation Specialist - Part-Time Freelance
Remote AI Annotation Specialist - Part-Time Freelance

Mindrift Data Annotation Projects • Buenos Aires

Presencial
Part-time
Remote work
Freelance project
Freelance Agent Evaluation Engineer
Freelance Agent Evaluation Engineer

AI Chopping Block • Buenos Aires

Híbrido
ARS 31.166.000 - 62.331.000
Flexible hours
Remote freelance project
Remote Freelance AI Evaluation Engineer
Remote Freelance AI Evaluation Engineer

AI Chopping Block • Buenos Aires

Híbrido
ARS 31.166.000 - 62.331.000
Flexible hours
Remote freelance project
Remote AI Code Engineer and Reviewer (Flexible Hours)
Remote AI Code Engineer and Reviewer (Flexible Hours)

Alignerr • La Plata

A distancia
ARS 125.058.000 - 250.117.000