Founding AI Researcher, Model Evaluation & Data Strategy

Talanto

San Francisco, Northern (CA, KY)

Hybrid

USD 200,000 - 350,000

Full time

29 hours ago
Be an early applicant

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Talanto is seeking a founding Applied AI Researcher focused on model evaluation and data strategy in a research-first role. You will design evaluations, define datasets and reward signals, and work with engineers to scale programs. Publishing is core and prior publication is essential.

The role requires modeling expertise across modalities, strong Python, and the ability to drive research independently. In-person SF Bay Area preference with open remote options across multiple regions.

Qualifications

  • Track record of published research at NeurIPS, ICML, ICLR, ACL or EMNLP is essential.
  • You have designed studies and evaluations, not just followed rubrics.
  • Comfort with non-deterministic domains and fast-moving research frameworks.
  • Agentic evaluation proficiency; RL environment experience with engineers.
  • Cross-modal understanding: audio, text, and vision require different techniques.
  • Strong Python, model APIs, and structured datasets; benchmark design, human eval, statistics.
  • Familiarity with SFT, preference optimization, RLHF/RLAIF, reward modeling, synthetic data.
  • Excellent technical writing and ability to drive ambiguous research independently.

Responsibilities

  • Design evaluations for generative, reasoning, tool-use, and agentic systems across modalities.
  • Own experimental design: hypothesize failures, build evals, quantify defects.
  • Build RL environments and reward signals with engineers.
  • Create quality systems: calibration, blind review, adjudication for non-deterministic domains.
  • Run pilots and publish work to position the company as a research partner.

Skills

Python
Publication record
Experimental design
Statistical analysis
Cross-modal understanding
RL environment experience
Benchmark design
Technical writing

Tools

Model APIs
RL environments
Eval frameworks

Job description

Talanto is seeking a founding Applied AI Researcher focused on model evaluation and data strategy in a research-first role. You will design evaluations, define datasets and reward signals, and work with engineers to scale programs. Publishing is core and prior publication is essential.

The role requires modeling expertise across modalities, strong Python, and the ability to drive research independently. In-person SF Bay Area preference with open remote options across multiple regions.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Founding Applied AI Researcher - Model Eval & Data Strategy
Founding Applied AI Researcher - Model Eval & Data Strategy

Morpheus Talent Solutions • United States

On-site
USD 120,000 - 180,000
Founding Applied AI Researcher - Model Evaluation & Data Strategy
Founding Applied AI Researcher - Model Evaluation & Data Strategy

Talanto • San Francisco (CA), Northern (KY)

Hybrid
USD 200,000 - 350,000
Applied AI Researcher
Applied AI Researcher

Morpheus Talent Solutions • United States

On-site
USD 120,000 - 180,000
Chief AI Evaluation & Research
Chief AI Evaluation & Research

Vals AI, Inc. • San Francisco (CA)

On-site
USD 220,000 - 340,000
Relocation support
Health insurance
Meals provided (Lunch/Dinner)
+3
Staff AI Evaluation Scientist
Staff AI Evaluation Scientist

Visa Hunt • San Francisco (CA), Northern (KY)

Hybrid
USD 140,000 - 200,000
Stock options
Health & wellness
Meals provided
+4
Founding Research PM: Model Capabilities Architect
Founding Research PM: Model Capabilities Architect

Abundant • San Francisco (CA)

On-site
USD 150,000 - 210,000
Health, dental, vision + flexible PTO
Frontier Language Model Evaluation Engineer
Frontier Language Model Evaluation Engineer

Artificial Analysis, Inc. • San Francisco (CA)

On-site
USD 170,000 - 230,000
Equity
Frontier AI exposure
Senior AI Researcher: Foundation Models Lead
Senior AI Researcher: Foundation Models Lead

AI Breaking Wire • Menlo Park (CA)

On-site
USD 180,000 - 300,000
AI Research scientist - Evals
AI Research scientist - Evals

Cerebro • San Francisco (CA)

On-site
USD 165,000 - 195,000
Equity
Relocation support
Health and dental insurance
+2
Staff AI Evaluations Engineer — Open Foundation Models
Staff AI Evaluations Engineer — Open Foundation Models

B Capital • San Francisco (CA)

On-site
USD 120,000 - 160,000
Top-tier compensation
Comprehensive medical, dental, vision, life, and disability insurance
Fully paid parental leave
+3