AI Personal Assistant Evaluator - Real-World Task Specialist

Mercor

San Francisco (CA)

On-site

USD 50,000 - 90,000

Part time

14 days+
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Job summary

Mercor, a leading AI research organization in the San Francisco area, is seeking advanced LLM power users to evaluate how AI systems handle personalized, real-world life tasks. You will judge usefulness, personalization, realism, and success across food, health, productivity, careers, and learning.

This role requires heavy personal use of AI tools and clear written judgments about what makes an AI output good or bad.

Qualifications

  • Extensive experience using LLMs for personal workflows.
  • Ability to judge usefulness, personalization and realism of AI outputs.
  • Strong written communication and attention to detail.
  • Experience explaining AI outputs and safety concerns.

Responsibilities

  • Evaluate AI responses for usefulness and alignment with user goals.
  • Provide clear explanations of what makes outputs good or bad.
  • Collaborate with researchers to improve future AI assistants.

Skills

Heavy AI usage
Multi-step tasks
AI tools familiarity
Explain AI outputs
Attention to detail

Tools

ChatGPT
Claude
Gemini
Perplexity
Cursor
Windsurf
Codex

Job description

Mercor, a leading AI research organization in the San Francisco area, is seeking advanced LLM power users to evaluate how AI systems handle personalized, real-world life tasks. You will judge usefulness, personalization, realism, and success across food, health, productivity, careers, and learning.

This role requires heavy personal use of AI tools and clear written judgments about what makes an AI output good or bad.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

AI Personal Assistant Quality Evaluator
AI Personal Assistant Quality Evaluator

Obsidian • San Francisco (CA)

On-site
USD 34,000 - 83,000
AI Personal Assistant Evaluator
AI Personal Assistant Evaluator

Mercor • San Francisco (CA)

On-site
USD 50,000 - 90,000
AI Personal Assistant Evaluator
AI Personal Assistant Evaluator

Obsidian • San Francisco (CA)

On-site
USD 34,000 - 83,000
LLM Power User & Real-World AI Evaluator
LLM Power User & Real-World AI Evaluator

Obsidian • San Francisco (CA)

Remote
USD 34,000 - 83,000
LLM Power User: Real-World Task Evaluator
LLM Power User: Real-World Task Evaluator

Obsidian • San Francisco (CA)

On-site
USD 55,000 - 96,000
AI Personal-Workflow Evaluator & Rubric Specialist
AI Personal-Workflow Evaluator & Rubric Specialist

Mercor • New York (NY)

Remote
USD 34,000 - 83,000
AI Workflow Evaluator & Personal Task Trainer
AI Workflow Evaluator & Personal Task Trainer

Obsidian • New York (NY)

On-site
USD 60,000 - 90,000
AI Personal Workflow Evaluator
AI Personal Workflow Evaluator

Obsidian • New York (NY)

Remote
USD 34,000 - 55,000
LLM Power User - AI Trainer
LLM Power User - AI Trainer

Obsidian • San Francisco (CA)

On-site
USD 55,000 - 96,000
Remote Personalized AI Assistant Evaluator
Remote Personalized AI Assistant Evaluator

OpenTrain AI • Northern (KY)

Hybrid
USD 69,000 - 276,000
Remote contract
Flexible schedule
20–40 hours per week