Staff AI Evaluations Engineer — Open Foundation Models

B Capital

San Francisco (CA)

On-site

USD 120,000 - 160,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Benefits offered by this job

Top-tier compensation
Comprehensive medical, dental, vision, life, and disability insurance
Fully paid parental leave
Paid time off
Lunch and dinner provided daily
Relocation support

Job summary

B Capital seeks a talented individual for an AI Evaluation role in San Francisco. This position involves conducting critical comparative analysis, refining evaluation systems, and collaborating with various teams to enhance model capabilities. The ideal candidate will have strong statistical analysis skills, familiarity with LLM evaluation methodologies, and possess a collaborative and detail-oriented approach. B Capital is dedicated to providing top-tier compensation and comprehensive benefits to support their employees.

Qualifications

  • Strong statistical analysis and experimental design skills.
  • Familiarity with LLM evaluation methodologies.
  • Detail-oriented and collaborative mindset.

Responsibilities

  • Conduct critical comparative analysis to advance understanding of model capabilities.
  • Build and refine evaluation systems that create feedback loops.
  • Collaborate closely with teams to translate insights into model improvements.

Skills

Statistical analysis
Experimental design
LLM evaluation methodologies
Collaboration
Detail-oriented

Job description

B Capital seeks a talented individual for an AI Evaluation role in San Francisco. This position involves conducting critical comparative analysis, refining evaluation systems, and collaborating with various teams to enhance model capabilities. The ideal candidate will have strong statistical analysis skills, familiarity with LLM evaluation methodologies, and possess a collaborative and detail-oriented approach. B Capital is dedicated to providing top-tier compensation and comprehensive benefits to support their employees.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Staff AI Evaluation Scientist
Staff AI Evaluation Scientist

Visa Hunt • San Francisco (CA), Northern (KY)

Hybrid
USD 140,000 - 200,000
Stock options
Health & wellness
Meals provided
+4
AI Evaluation Lead: Real-World Systems Benchmarking
AI Evaluation Lead: Real-World Systems Benchmarking

SupportFinity™ • San Francisco (CA)

On-site
USD 150,000 - 230,000
Senior AI/ML Engineer: Training & Evaluation (Remote)
Senior AI/ML Engineer: Training & Evaluation (Remote)

Prolific • San Francisco (CA)

On-site
USD 80,000 - 100,000
AI Risk & Fraud Evaluation Engineer
AI Risk & Fraud Evaluation Engineer

Variance • San Francisco (CA)

On-site
USD 170,000 - 230,000
Competitive salary
Platinum-level medical, dental, and vision insurance
Unlimited PTO
+2
Applied AI Researcher
Applied AI Researcher

Morpheus Talent Solutions • United States

On-site
USD 120,000 - 180,000
Foundation Models Evaluation Scientist (Multimodal ML)
Foundation Models Evaluation Scientist (Multimodal ML)

Apple • Boulder (CO)

On-site
USD 132,000 - 245,000
Founding Applied AI Researcher - Model Eval & Data Strategy
Founding Applied AI Researcher - Model Eval & Data Strategy

Morpheus Talent Solutions • United States

On-site
USD 120,000 - 180,000
Founding AI Researcher, Model Evaluation & Data Strategy
Founding AI Researcher, Model Evaluation & Data Strategy

Talanto • San Francisco (CA), Northern (KY)

Hybrid
USD 200,000 - 350,000
Staff AI Engineer - LLMs, Evaluation & Training
Staff AI Engineer - LLMs, Evaluation & Training

Boson AI • Santa Clara (CA)

On-site
USD 150,000 - 600,000
AI Alignment Research Engineer — Evaluation & Safety
AI Alignment Research Engineer — Evaluation & Safety

W3 Sourcing • San Francisco (CA)

Hybrid
USD 140,000 - 210,000