AI Quality & Evaluation Scientist for Clinical LLMs

Bioscope.ai, Inc.

Boston (MA)

On-site

USD 100,000 - 130,000

Full time

14 days+
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

A leading clinical AI company is seeking a Data Scientist responsible for ensuring the quality and reliability of AI outputs. You will design automated evaluation pipelines, develop uncertainty quantification systems, and build comprehensive frameworks that combine automated assessments with clinician validations. The ideal candidate has expertise in deep learning frameworks such as PyTorch, experience with model evaluation metrics, and excellent communication skills. A Master's degree in a related field is preferred.

Qualifications

  • Strong foundation in deep learning frameworks (PyTorch) and LLM architectures.
  • Experience with model evaluation, benchmarking, and quality metrics.
  • Proficiency in Python and modern ML development tools.

Responsibilities

  • Design and implement automated evaluation pipelines to assess AI output quality.
  • Develop uncertainty quantification systems correlating confidence scores with accuracy.
  • Build evaluation frameworks combining automated assessment and clinician-validated cases.

Skills

Deep learning frameworks (PyTorch)
Model evaluation and quality metrics
Proficiency in Python
Statistical analysis
Communication skills

Education

Master's degree in Computer Science, Machine Learning, Statistics, or related field

Job description

A leading clinical AI company is seeking a Data Scientist responsible for ensuring the quality and reliability of AI outputs. You will design automated evaluation pipelines, develop uncertainty quantification systems, and build comprehensive frameworks that combine automated assessments with clinician validations. The ideal candidate has expertise in deep learning frameworks such as PyTorch, experience with model evaluation metrics, and excellent communication skills. A Master's degree in a related field is preferred.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Data Scientist (AI Quality & Evaluation)
Data Scientist (AI Quality & Evaluation)

Bioscope.ai, Inc. • Boston (MA)

On-site
USD 100,000 - 130,000
Senior AI Evaluation Scientist: LLM Quality & Improvement
Senior AI Evaluation Scientist: LLM Quality & Improvement

Evolent Health LLC • United States

Remote
USD 135,000 - 165,000
Health insurance
Remote AI Data Engineer: LLM Evaluation & Validation
Remote AI Data Engineer: LLM Evaluation & Validation

Veeva Systems • Portland (ME)

Hybrid
USD 85,000 - 225,000
AI Data Engineer: AI Agent Evaluation & Validation
AI Data Engineer: AI Agent Evaluation & Validation

Veeva Systems • Portland (OR)

Hybrid
USD 85,000 - 225,000
Senior AI Quality Engineer — LLMs & Evaluation Systems
Senior AI Quality Engineer — LLMs & Evaluation Systems

Block • San Francisco (CA)

On-site
USD 190,000 - 230,000
Applied Scientist, AGI Quality & LLM Evaluation
Applied Scientist, AGI Quality & LLM Evaluation

Amazon • Factoria (WA)

On-site
USD 136,000 - 184,000
LLM Evaluation Lead: Healthcare AI Quality & Safety
LLM Evaluation Lead: Healthcare AI Quality & Safety

Fluency Digital, Inc. • New York (NY)

On-site
USD 120,000 - 150,000
Applied Scientist - AGI Quality & LLM Evaluation
Applied Scientist - AGI Quality & LLM Evaluation

Socket.dev • Bellevue (WA)

On-site
USD 136,000 - 184,000
Health insurance
RSUs
Sign-on bonus
+1
Applied Scientist — AGI, LLM Quality & Evaluation
Applied Scientist — AGI, LLM Quality & Evaluation

Amazon • Bellevue (WA), Northern (KY)

Hybrid
USD 136,000 - 184,000
RSUs
Sign-on bonus
Health insurance
+2
Senior AI Engineer: LLM Evaluation & Production
Senior AI Engineer: LLM Evaluation & Production

LawPro.ai • Town of Florida (NY)

On-site
USD 140,000 - 210,000