Senior Speech & Audio Data Scientist - Benchmarking

Innodata Inc.

United States

On-site

USD 160,000 - 185,000

Full time

6 days ago
Be an early applicant
Application generator

An application made for this job — a tailored resume and cover letter that speak straight to the posting.

Get past ATS filters

Job summary

Innodata is hiring a Research Scientist to own the data and evaluation science behind speech and audio models used in ASR, TTS, and conversational voice.

You will define data specifications, transcription schemas, and sampling strategies, then build robust evaluation methods that go beyond word error rate to measure robustness, latency, and naturalness. You’ll collaborate with customers and labs to shape data to objectiv es.

Qualifications

  • 5+ years of hands-on industry experience in speech or audio ML.
  • Bachelor's degree in CS, EE, or related field; MS/PhD preferred.
  • Experience training and evaluating ASR, TTS, or audio-language models with PyTorch.
  • Fluency with ESPnet, NeMo, SpeechBrain, Kaldi, HuggingFace and related metrics.

Responsibilities

  • Define how Innodata designs, structures, and evaluates audio data for speech and audio models, and validate those choices experimentally.
  • Translate model requirements into concrete data specifications: modalities, transcription/annotation schemas, sampling, and evaluation criteria.
  • Build evaluation methodology beyond WER to include semantic accuracy, noise/accents, DER, naturalness, and streaming latency.

Skills

Speech ML
PyTorch
Audio datasets
Benchmarking

Education

Bachelor's degree in CS/EE or related field

Tools

ESPnet
NeMo
SpeechBrain
Kaldi
HuggingFace
WER/CER metrics

Job description

Innodata is hiring a Research Scientist to own the data and evaluation science behind speech and audio models used in ASR, TTS, and conversational voice.

You will define data specifications, transcription schemas, and sampling strategies, then build robust evaluation methods that go beyond word error rate to measure robustness, latency, and naturalness. You’ll collaborate with customers and labs to shape data to objectiv es.

Get your free, confidential resume review.

or drag and drop your file here.

Similar jobs

Similar jobs worth comparing

Research Scientist, Speech & Audio
Research Scientist, Speech & Audio

Innodata Inc. • United States

On-site
USD 160,000 - 185,000
Senior Data Scientist, Audio — AI-Driven Speech Insights
Senior Data Scientist, Audio — AI-Driven Speech Insights

Deepgram • United States

On-site
USD 120,000 - 190,000
Senior Data Scientist, Speech AI & Data Strategy
Senior Data Scientist, Speech AI & Data Strategy

Deepgram • Northern (KY)

Hybrid
USD 110,000 - 170,000
Senior Data Scientist, Voice AI Innovator
Senior Data Scientist, Voice AI Innovator

Praxy • Northern (KY)

Hybrid
USD 90,000 - 130,000
Voice AI Quality Analyst
Voice AI Quality Analyst

Innodata Inc. • Delaware

On-site
USD 28,000 - 37,000
AI Voice Evaluation Specialist
AI Voice Evaluation Specialist

Innodata Inc. • Town of Florida (NY)

On-site
USD 28,000 - 37,000
AI Voice Evaluation Specialist
AI Voice Evaluation Specialist

Innodata Inc. • Town of Texas (WI)

On-site
USD 28,000 - 37,000
AI Voice Evaluation Specialist
AI Voice Evaluation Specialist

Innodata Inc. • Alaska

On-site
USD 28,000 - 37,000
AI Voice Evaluation Specialist
AI Voice Evaluation Specialist

Innodata Inc. • New Jersey

On-site
USD 28,000 - 37,000
AI Voice Evaluation Specialist
AI Voice Evaluation Specialist

Innodata Inc. • Delaware

On-site
USD 28,000 - 37,000