STEM & Technical Specialist – Rubric Design

AI Trainer Jobs

United States

Remote

USD 114,000 - 162,000

Full time

3 days ago
Be an early applicant
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Job summary

AI Trainer Jobs is seeking a STEM & Technical SME to craft expert-level questions, evaluate AI outputs, and design rigorous rubrics in a remote hourly contractor role.

You will develop problems that require multi-step reasoning, identify weaknesses in frontier AI models, and translate complex judgments into clear, measurable criteria, including partial-credit standards and edge-case considerations. You will contribute to RLHF/SFT workflows while maintaining high professional standards in English.

Qualifications

  • Bachelor’s degree or higher in Mathematics, Physics, Chemistry, Engineering, Computer Science, Statistics, Applied Science, or another technical discipline.
  • Strong professional proficiency in English, minimum C1, with the ability to write precise technical explanations and evaluation criteria.
  • 3+ years of professional, academic, research, or industry experience in your stated technical domain.
  • Demonstrated advanced expertise in a clearly defined technical field or specialization.
  • Ability to create challenging technical questions that require multi-step reasoning, domain expertise, or professional judgment.
  • Strong ability to design detailed evaluation rubrics defining required reasoning, correct methodology, acceptable alternatives, partial-credit criteria, and critical errors.
  • Ability to distinguish between a correct final answer and an answer supported by valid versus flawed reasoning.
  • Comfortable reviewing and critiquing other experts’ rubrics for ambiguity, missing criteria, redundancy, technical inaccuracies, or poor scoring design.
  • High attention to detail when evaluating formulas, assumptions, units, methodology, edge cases, logical consistency, and technical terminology.
  • Experience with exam writing, academic grading, peer review, research review, technical QA, standards development, or assessment design is strongly preferred.
  • Prior experience with AI evaluation, RLHF, SFT, benchmarking, data annotation, prompt design, or LLM evaluation is preferred.
  • Reliable, self-directed, and able to deliver consistent quality in an hourly, remote contractor workflow.

Responsibilities

  • Create expert-level technical questions: Develop difficult questions that test genuine technical reasoning and expose weaknesses in advanced AI systems.
  • Design evaluation rubrics: Write structured criteria defining what a correct, rigorous, and complete response must contain.
  • Define partial-credit standards: Identify essential reasoning steps, acceptable alternatives, minor errors, and critical failures.
  • Evaluate AI-generated solutions: Assess outputs for correctness, reasoning quality, completeness, methodology, and technical precision.
  • Identify hidden reasoning errors: Detect cases where an answer reaches the correct conclusion using invalid assumptions or flawed logic.
  • Critique peer rubrics: Review other experts’ criteria for technical accuracy, clarity, completeness, and scoring consistency.
  • Develop reference content: Produce expert answers, explanations, critiques, and other gold-standard content.
  • Support AI training: Create questions, rubrics, evaluations, preference judgments, and reference-answer pairs suitable for RL and SFT workflows.
  • Maintain technical rigor: Ensure content reflects appropriate professional or academic standards within the relevant discipline.

Skills

STEM
Mathematics
Physics
Chemistry
Engineering
Computer Science
Technical Reasoning
AI Evaluation
Rubric Design
Rubric Writing
Benchmarking
Model Evaluation
Question Writing
Expert Review
English

Education

Bachelor’s degree or higher in a technical discipline

Job description

Pay: up to $100/hour

In this hourly, remote contractor role, you will work as a STEM & Technical Subject Matter Expert (SME) to create challenging expert-level questions, evaluate AI-generated technical content, and design detailed rubrics that define what a correct, rigorous, and expert-quality answer should contain.

You will develop problems within your area of expertise that test advanced reasoning rather than simple factual recall. You will identify weaknesses in frontier AI models, including incorrect assumptions, incomplete reasoning, mathematical or scientific errors, missed edge cases, and answers that appear plausible but fail under expert scrutiny.

A major focus of this role is rubric design and writing. You will translate complex technical judgment into clear, specific, and measurable evaluation criteria, including required concepts, reasoning steps, acceptable alternative approaches, critical errors, and partial-credit considerations. You may also critique and improve rubrics developed by other experts.

This role is with SME Careers, a fast-growing AI Data Services company and subsidiary of SuperAnnotate, delivering training data for many of the world’s largest AI companies and foundation-model labs. Your technical expertise directly helps improve the world’s premier AI models by making their reasoning more accurate, rigorous, and reliable.

Responsibilities
  • Create expert-level technical questions: Develop difficult questions that test genuine technical reasoning and expose weaknesses in advanced AI systems.
  • Design evaluation rubrics: Write structured criteria defining what a correct, rigorous, and complete response must contain.
  • Define partial-credit standards: Identify essential reasoning steps, acceptable alternatives, minor errors, and critical failures.
  • Evaluate AI-generated solutions: Assess outputs for correctness, reasoning quality, completeness, methodology, and technical precision.
  • Identify hidden reasoning errors: Detect cases where an answer reaches the correct conclusion using invalid assumptions or flawed logic.
  • Critique peer rubrics: Review other experts’ criteria for technical accuracy, clarity, completeness, and scoring consistency.
  • Develop reference content: Produce expert answers, explanations, critiques, and other gold-standard content.
  • Support AI training: Create questions, rubrics, evaluations, preference judgments, and reference-answer pairs suitable for RL and SFT workflows.
  • Maintain technical rigor: Ensure content reflects appropriate professional or academic standards within the relevant discipline.
Requirements
  • Bachelor’s degree or higher in Mathematics, Physics, Chemistry, Engineering, Computer Science, Statistics, Applied Science, or another technical discipline.
  • Strong professional proficiency in English, minimum C1, with the ability to write precise technical explanations and evaluation criteria.
  • 3+ years of professional, academic, research, or industry experience in your stated technical domain.
  • Demonstrated advanced expertise in a clearly defined technical field or specialization.
  • Ability to create challenging technical questions that require multi-step reasoning, domain expertise, or professional judgment.
  • Strong ability to design detailed evaluation rubrics defining required reasoning, correct methodology, acceptable alternatives, partial-credit criteria, and critical errors.
  • Ability to distinguish between a correct final answer and an answer supported by valid versus flawed reasoning.
  • Comfortable reviewing and critiquing other experts’ rubrics for ambiguity, missing criteria, redundancy, technical inaccuracies, or poor scoring design.
  • High attention to detail when evaluating formulas, assumptions, units, methodology, edge cases, logical consistency, and technical terminology.
  • Experience with exam writing, academic grading, peer review, research review, technical QA, standards development, or assessment design is strongly preferred.
  • Prior experience with AI evaluation, RLHF, SFT, benchmarking, data annotation, prompt design, or LLM evaluation is preferred.
  • Reliable, self-directed, and able to deliver consistent quality in an hourly, remote contractor workflow.

Skills: STEM, Mathematics, Physics, Chemistry, Engineering, Computer Science, Technical Reasoning, AI Evaluation, Rubric Design, rubric writing, Benchmarking, Model Evaluation, Question Writing, Expert Review, English

Open to candidates in: The United States

Interview language: English

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Healthcare Specialist – Rubric Design
Healthcare Specialist – Rubric Design

AI Trainer Jobs • United States

Remote
USD 83,000 - 138,000
Remote STEM & Technical Expert: Rubrics & AI Evaluation
Remote STEM & Technical Expert: Rubrics & AI Evaluation

AI Trainer Jobs • United States

Remote
USD 114,000 - 162,000
Finance & Accounting Specialist – Rubric Design
Finance & Accounting Specialist – Rubric Design

AI Trainer Jobs • United States

Remote
USD 83,000 - 138,000
Legal & Compliance Specialist – Rubric Design
Legal & Compliance Specialist – Rubric Design

AI Trainer Jobs • United States

Remote
USD 152,000 - 179,000
Remote | Educator/ Assessor Writer — $90–$140/hour
Remote | Educator/ Assessor Writer — $90–$140/hour

24-Mag Llc • Northern (KY), New York (NY)

Hybrid
USD 124,000 - 193,000
Scientific and Technical Service Specialist - Freelance AI Trainer Project
Scientific and Technical Service Specialist - Freelance AI Trainer Project

Invisible Technologies Inc. • United States

Remote
USD 14,000 - 41,000
Expert Professionals — STEM Research
Expert Professionals — STEM Research

AI Trainer Jobs • United States

Remote
USD 96,000 - 138,000
Applied Computer Science Benchmark Specialist
Applied Computer Science Benchmark Specialist

Weekday AI • United States

Remote
USD 91,000 - 116,000
JSON-fluent & Rubrics Expert
JSON-fluent & Rubrics Expert

Weekday 1 • United States

Remote
USD 69,000 - 241,000
Fully remote
Flexible hours
Weekly payments
Applied Computer Science Benchmark Specialist
Applied Computer Science Benchmark Specialist

Weekday 1 • United States

Remote
USD 91,000 - 116,000
Fully remote