Remote AI Evaluation Specialist (English)

Executive Staff Recruiters / ESR Healthcare

United States

Remote

USD 60,000 - 90,000

Part time

14 days+
Application generator

Turn this role into an interview — a resume and cover letter built around what this employer wants.

Get past ATS filters

Job summary

ESR Healthcare in the United States is seeking an English-speaking Generalist contractor to support AI model evaluation. You will create prompts, run tests, and document results by recording your screen and voice as you compare multiple models.

The role requires clear American English, attention to detail, and the ability to follow project guidelines. Prior experience with AI evaluation or data annotation is a plus.

Qualifications

  • High-level fluency in spoken and written American English.
  • Experience using large language models such as ChatGPT, Claude, Gemini.
  • Familiarity with AI evaluation tasks.
  • Comfortable recording screen and audio during sessions.

Responsibilities

  • Create diverse prompts across topics to test language models.
  • Submit identical prompts to both ChatGPT and Claude and record your screen and microphone during the process.
  • Provide detailed, structured verbal feedback in clear American English, explaining your reasoning and preferences.
  • Maintain clarity and professionalism in both spoken and written communication during each recording session.
  • Interpret provided documentation to ensure consistent evaluation standards and accurate project delivery.
  • Collaborate closely with project guidelines to support continuous improvement of AI models.

Skills

Fluent American English
Critical thinking
Analytical reasoning
Attention to detail
Clear communication

Tools

ChatGPT
Claude
Gemini

Job description

ESR Healthcare in the United States is seeking an English-speaking Generalist contractor to support AI model evaluation. You will create prompts, run tests, and document results by recording your screen and voice as you compare multiple models.

The role requires clear American English, attention to detail, and the ability to follow project guidelines. Prior experience with AI evaluation or data annotation is a plus.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Remote Bilingual Mental Health AI Evaluator
Remote Bilingual Mental Health AI Evaluator

Executive Staff Recruiters / ESR Healthcare • United States

Remote
USD 83,000 - 165,000
Remote Robotics Evaluation Specialist for AI Training
Remote Robotics Evaluation Specialist for AI Training

ESR Healthcare • Palo Alto (CA)

Remote
USD 20,664 - 27,552
Remote AI English Language Specialist
Remote AI English Language Specialist

YO AI Labs • Philadelphia

Remote
USD 55,000 - 83,000
Remote AI Evaluation Specialist — American English Voice Actor
Remote AI Evaluation Specialist — American English Voice Actor

AuraOne, Inc. • United States

On-site
USD 59,000 - 80,000
Remote Data Annotation Generalist for AI Training
Remote Data Annotation Generalist for AI Training

Executive Staff Recruiters / ESR Healthcare • United States

Remote
USD 69,000 - 124,000
Remote AI Language QA Specialist
Remote AI Language QA Specialist

YO AI Labs • Atlanta (GA)

Remote
USD 55,000 - 96,000
Remote AI Prompt Evaluator & Quality Assurance Specialist
Remote AI Prompt Evaluator & Quality Assurance Specialist

Crossing Hurdles • United States

Remote
USD 48,216 - 55,104
Remote Healthcare AI Evaluator - Contractor
Remote Healthcare AI Evaluator - Contractor

YO AI Labs • Washington

Remote
USD 83,000 - 124,000
AI Model Evaluator (Remote Contract)
AI Model Evaluator (Remote Contract)

Appsierra Group • United States

On-site
USD 104,000 - 146,000
Fully remote
Flexible schedule
Weekly onboarding and ongoing projects
Remote AI Data Annotator & Evaluator
Remote AI Data Annotator & Evaluator

YO AI Labs • New York (NY)

Remote
USD 34,000 - 55,000