Senior Retail AI Evaluation Lead

Obsidian

New York (NY)

Remote

USD 70,000 - 90,000

Full time

14 days+
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Job summary

Cincinnatus LLC is seeking a Retail SME to support an AI training data program for a leading AI lab in the United States. You will judge real-world retail tasks and help ensure quality by evaluating outputs against rubrics, guiding teams, and shaping evaluation guidelines.

Required: 8+ years in retail at top-tier companies, hands-on rubric evaluation of LLMs, and ability to commit 35+ hours per week on weekdays. This is a W-2 role through Cincinnatus, with placement at a premier AI facility.

Qualifications

  • 8+ years of dedicated professional experience in retail at top-tier organizations.
  • Hands-on experience evaluating LLM/AI model outputs against rubrics or structured scoring criteria.
  • Demonstrable career progression (e.g., Category Manager to Director).
  • Ability to engage reliably for at least 35 hours/week during weekdays.
  • Strong verbal and written communication, problem-solving and interpersonal skills.

Responsibilities

  • Guide research and engineering teams to close knowledge gaps in retail merchandising, category management, and operations reasoning.
  • Design domain-relevant retail tasks and write accurate, well-reasoned solutions grounded in real retail practice.
  • Evaluate AI model outputs against structured rubrics and provide clear feedback on correctness, judgment, and reasoning quality.
  • Develop and refine evaluation guidelines and scoring rubrics specific to retail tasks.
  • Collaborate with other subject matter experts to ensure consistency and accuracy in training data.

Skills

Retail domain expertise
Rubrics evaluation experience
Communication skills
Problem solving

Job description

Cincinnatus LLC is seeking a Retail SME to support an AI training data program for a leading AI lab in the United States. You will judge real-world retail tasks and help ensure quality by evaluating outputs against rubrics, guiding teams, and shaping evaluation guidelines.

Required: 8+ years in retail at top-tier companies, hands-on rubric evaluation of LLMs, and ability to commit 35+ hours per week on weekdays. This is a W-2 role through Cincinnatus, with placement at a premier AI facility.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Retail AI Evaluation Specialist
Retail AI Evaluation Specialist

Mercor • New York (NY)

Remote
USD 110,000 - 170,000
Senior Retail AI Evaluation Specialist
Senior Retail AI Evaluation Specialist

Mercor • New York (NY)

On-site
USD 120,000 - 180,000
Retail SME - AI Evaluation Expert
Retail SME - AI Evaluation Expert

Obsidian • New York (NY)

On-site
USD 120,000 - 170,000
Retail SME - AI Evaluation Expert
Retail SME - AI Evaluation Expert

Mercor • New York (NY)

On-site
USD 120,000 - 180,000
Retail Specialist
Retail Specialist

Mercor • United States

On-site
USD 120,000 - 180,000
Retail AI Evaluation Specialist
Retail AI Evaluation Specialist

aitrainer • United States

On-site
Retail LLM Training & Evaluation Lead
Retail LLM Training & Evaluation Lead

CapitexAI • United States

On-site
USD 83,000 - 110,000
Brand Strategy Expert for AI Model Evaluation
Brand Strategy Expert for AI Model Evaluation

Mercor • San Francisco (CA)

On-site
USD 140,000 - 190,000
GenAI Marketing Strategist — AI Training Evaluation
GenAI Marketing Strategist — AI Training Evaluation

Mercor • New York (NY)

On-site
USD 130,000 - 180,000
Insurance AI Evaluation Specialist
Insurance AI Evaluation Specialist

Obsidian • San Francisco (CA)

Remote
USD 120,000 - 180,000