Research Scientist: Model Evaluation & Quality Metrics

Sanas

Palo Alto (CA)

On-site

USD 140,000 - 210,000

Full time

14 days+
Application generator

Get a reply from this employer — a resume and cover letter tailored to exactly what they’re hiring for.

Get past ATS filters

Job summary

Sanas in Palo Alto is seeking a Research Scientist focused on rigorous evaluation of speech AI models. You will define meaningful metrics, build scalable evaluation pipelines, and align research progress with product impact across Accent Translation, Noise Cancellation, and Speech Enhancement.

The role requires deep expertise in evaluation methodologies, strong programming in Python and PyTorch, and the ability to run human studies and ablations at scale, partnering with ML research, product,

Qualifications

  • 4+ years of research or applied research experience in speech, audio, or NLP.
  • Experience designing and running human evaluation studies with statistical rigor.
  • Strong engineering skills to build production-quality evaluation pipelines in Python and PyTorch.

Responsibilities

  • Design and own evaluation frameworks across Sanas's model portfolio, ensuring metrics capture meaningful progress.
  • Develop quantitative metrics for subjective and perceptual qualities and align with product goals.
  • Build evaluation systems bridging automated metrics and human judgment; run robust listening tests.
  • Define evaluation splits and benchmark suites reflecting real production conditions.

Skills

Research experience
Python
PyTorch
Speech/Audio/NLP
Evaluation methodology

Job description

Sanas in Palo Alto is seeking a Research Scientist focused on rigorous evaluation of speech AI models. You will define meaningful metrics, build scalable evaluation pipelines, and align research progress with product impact across Accent Translation, Noise Cancellation, and Speech Enhancement.

The role requires deep expertise in evaluation methodologies, strong programming in Python and PyTorch, and the ability to run human studies and ablations at scale, partnering with ML research, product,

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Research Scientist: Model Evaluation & Metrics
Research Scientist: Model Evaluation & Metrics

Sanas.AI Inc. • Palo Alto (CA), Northern (KY)

Hybrid
USD 140,000 - 230,000
Research Scientist (Model Evaluation)
Research Scientist (Model Evaluation)

Sanas • Palo Alto (CA)

On-site
USD 140,000 - 210,000
Research Scientist (Model Evaluation)
Research Scientist (Model Evaluation)

Sanas.AI Inc. • Palo Alto (CA), Northern (KY)

Hybrid
USD 140,000 - 230,000
Research Scientist (Model Evaluation)
Research Scientist (Model Evaluation)

Jobless • Palo Alto (CA), Northern (KY)

Hybrid
USD 140,000 - 210,000
Member of Technical Staff, Research Evaluations
Member of Technical Staff, Research Evaluations

Sanas • Palo Alto (CA)

On-site
USD 140,000 - 190,000
Senior AI Systems Engineer: Model Evaluation & QA
Senior AI Systems Engineer: Model Evaluation & QA

Deepgram • United States

Remote
USD 140,000 - 210,000
Evaluations Lead, Generative Speech AI
Evaluations Lead, Generative Speech AI

Sanas • Palo Alto (CA)

On-site
USD 140,000 - 190,000
Senior ML Inference Engineer — Real-Time Systems
Senior ML Inference Engineer — Real-Time Systems

Sanas • Palo Alto (CA)

On-site
USD 180,000 - 240,000
Senior Audio ML Research Engineer
Senior Audio ML Research Engineer

David AI • San Francisco (CA)

On-site
USD 210,000 - 360,000
Unlimited PTO
Health, dental, vision coverage
FSA & HSA access
+3
Senior Audio & Speech AI Scientist
Senior Audio & Speech AI Scientist

Adobe Inc. • San Francisco (CA)

On-site
USD 187,000 - 271,000