AI Personal Assistant Quality Evaluator

Obsidian

San Francisco (CA)

On-site

USD 34,000 - 83,000

Part time

14 days+
Application generator

Stand out for this role — generate a tailored resume and cover letter in about a minute.

Get past ATS filters

Job summary

Obsidian in San Francisco is seeking advanced LLM power users to evaluate how AI systems perform on personalized, real-world life tasks. You will assess usefulness, realism, and practical success of AI responses in daily activities.

Ideal candidates regularly use AI tools in their personal lives and can explain what makes outputs good or bad, including multi-step planning, research, and decision-making. 20–40 hours per week engagement is expected.

Qualifications

  • Experience using AI tools for everyday tasks and decision making.
  • Ability to evaluate AI outputs for usefulness, realism, and personalization.
  • Clear written explanations of what makes an AI output good or bad.

Responsibilities

  • Evaluate AI responses across real-world life tasks and contexts.
  • Judge usefulness, personalization, and success against user goals.
  • Document criteria for good, bad, incomplete or unsafe outputs.

Skills

Heavy AI usage
Multistep task handling
Strong written judgment

Tools

ChatGPT
Claude
Gemini
Perplexity
Cursor
Windsurf
Codex

Job description

Obsidian in San Francisco is seeking advanced LLM power users to evaluate how AI systems perform on personalized, real-world life tasks. You will assess usefulness, realism, and practical success of AI responses in daily activities.

Ideal candidates regularly use AI tools in their personal lives and can explain what makes outputs good or bad, including multi-step planning, research, and decision-making. 20–40 hours per week engagement is expected.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

AI Personal Assistant Evaluator - Real-World Task Specialist
AI Personal Assistant Evaluator - Real-World Task Specialist

Mercor • San Francisco (CA)

On-site
USD 50,000 - 90,000
AI Personal Assistant Evaluator
AI Personal Assistant Evaluator

Mercor • San Francisco (CA)

On-site
USD 50,000 - 90,000
AI Personal Assistant Evaluator
AI Personal Assistant Evaluator

Obsidian • San Francisco (CA)

On-site
USD 34,000 - 83,000
AI Personal Workflow Evaluator
AI Personal Workflow Evaluator

Obsidian • New York (NY)

Remote
USD 34,000 - 55,000
LLM Power User & Real-World AI Evaluator
LLM Power User & Real-World AI Evaluator

Obsidian • San Francisco (CA)

Remote
USD 34,000 - 83,000
LLM Power User: Real-World Task Evaluator
LLM Power User: Real-World Task Evaluator

Obsidian • San Francisco (CA)

On-site
USD 55,000 - 96,000
AI Workflow Evaluator & Personal Task Trainer
AI Workflow Evaluator & Personal Task Trainer

Obsidian • New York (NY)

On-site
USD 60,000 - 90,000
Senior Personal AI Assistant Evaluator
Senior Personal AI Assistant Evaluator

Dorado • United States

Remote
USD 34,000 - 55,000
LLM Power User - AI Trainer
LLM Power User - AI Trainer

Obsidian • San Francisco (CA)

On-site
USD 55,000 - 96,000
LLM Power User - Fully Remote | Upto $200/hr
LLM Power User - Fully Remote | Upto $200/hr

Obsidian • San Francisco (CA)

Remote
USD 34,000 - 83,000