Remote AI Evaluation Guidelines Architect

Weekday AI

United States

À distance

USD 62 000 - 90 000

Plein temps

14 jours+
Générateur de candidature

Obtenez une réponse de cet employeur — un CV et une lettre de motivation adaptés exactement à ce qu’il recherche.

Passez les filtres ATS

Résumé du poste

Weekday AI is hiring for a remote, full-time role focused on shaping how AI systems are trained through precise guidelines for human evaluators. You will translate complex requirements into clear, actionable rater instructions across finance, retail, insurance, legal, and sports.

Work is fully remote with a 35-hour weekday commitment. The position emphasizes documenting evaluation rubrics, improving clarity, and maintaining consistency across multiple domains in collaboration with researchers

Qualifications

  • Minimum 3 years of professional experience in linguistics, instructional design, technical writing, or AI content development.
  • Direct experience creating or refining evaluation guidelines, rating rubrics, or reviewer instructions in generative AI or AI data annotation.
  • Ability to convert domain knowledge into clear, structured documentation across multiple subjects.
  • Proven ability to resolve ambiguity and improve specifications with measurable improvements.
  • Strong analytical thinking and exceptional attention to detail.
  • Clear career progression and professional growth.
  • Ability to commit 35+ hours per week during weekdays.
  • Outstanding written communication to explain nuanced concepts clearly.

Responsabilités

  • Translate complex program requirements into clear, concise, and easy-to-follow rater guidelines.
  • Design comprehensive evaluation rubrics and scoring frameworks that enable consistent decision-making across a variety of AI tasks.
  • Review existing documentation to identify ambiguity, inconsistencies, contradictions, and coverage gaps, then revise guidelines to improve clarity and usability.
  • Convert subject-matter requirements from domains such as finance, retail, insurance, legal, and sports into structured evaluation instructions that non-domain raters can apply confidently.
  • Collaborate with research teams, program managers, and subject matter experts to maintain consistency across multiple guideline sets.
  • Develop documentation that addresses edge cases, exceptions, and complex evaluation scenarios while minimizing reviewer escalation.

Connaissances

Linguistics
Instructional Design
Technical Writing
AI Content Development

Description du poste

Weekday AI is hiring for a remote, full-time role focused on shaping how AI systems are trained through precise guidelines for human evaluators. You will translate complex requirements into clear, actionable rater instructions across finance, retail, insurance, legal, and sports.

Work is fully remote with a 35-hour weekday commitment. The position emphasizes documenting evaluation rubrics, improving clarity, and maintaining consistency across multiple domains in collaboration with researchers

Obtenez votre examen gratuit et confidentiel de votre CV.

ou faites glisser et déposez votre fichier ici.

Similar jobs

Postes similaires à comparer

Remote AI Evaluation Guidelines Architect
Remote AI Evaluation Guidelines Architect

TrulyHired • États-Unis

Sur place
USD 61 992 - 89 544
Fully remote engagement
Remote AI Rating & Guidelines Writer
Remote AI Rating & Guidelines Writer

Weekday 1 • États-Unis

À distance
USD 62 000 - 90 000
Fully remote engagement
Remote AI Evaluation Architect - Tech Docs & Code
Remote AI Evaluation Architect - Tech Docs & Code

Weekday 1 • États-Unis

À distance
USD 21 000 - 28 000
Fully remote
Flexible hours
Weekly payments
Data Science Evaluation Architect (Remote, Flexible Hours)
Data Science Evaluation Architect (Remote, Flexible Hours)

Weekday AI • États-Unis

À distance
USD 165 000 - 234 000
Fully remote
Weekly payments
Remote AI Insurance Evaluation Specialist, 35+ hrs/wk
Remote AI Insurance Evaluation Specialist, 35+ hrs/wk

Weekday 1 • États-Unis

À distance
USD 83 000 - 110 000
Remote Retail AI Evaluation Specialist
Remote Retail AI Evaluation Specialist

Weekday AI • États-Unis

À distance
USD 83 000 - 110 000
AI Evaluation Architect - Data Science Expert (Remote)
AI Evaluation Architect - Data Science Expert (Remote)

Weekday AI (YC W21) • États-Unis

Sur place
USD 165 312 - 234 192
Fully remote
Weekly payments
Senior Insurance Specialist for AI Evaluation (Remote)
Senior Insurance Specialist for AI Evaluation (Remote)

Weekday AI • États-Unis

À distance
USD 83 000 - 110 000
Remote work
Senior Insurance Expert for AI Training & Evaluation - Remote
Senior Insurance Expert for AI Training & Evaluation - Remote

Weekday AI • États-Unis

À distance
Confidential
Remote work
Flexible hours
Remote HR Operations AI Evaluator & Rubric Reviewer
Remote HR Operations AI Evaluator & Rubric Reviewer

AI Trainer Jobs • États-Unis

À distance
USD 28 000 - 55 000