AI Evaluation & Quality Engineer

Capitalrx

Charlotte (NC)

On-site

USD 134,800 - 168,500

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Judi Health is seeking an AI Evaluation Engineer in Charlotte, NC to design and operate robust evaluation frameworks for AI models and autonomous agents. You will partner with scientists and engineers to translate product goals into measurable quality targets and lead end-to-end evaluation from unit tests to online analytics.

The role focuses on data engineering, platform observability, and tooling to support continuous quality and safety benchmarking.

Qualifications

  • 4+ years of data engineering, ML engineering, or software engineering experience.
  • Bachelor’s or Master’s degree in Computer Science, Machine Learning, or related quantitative field.
  • Strong proficiency in Python.
  • Experience building and maintaining production data pipelines.
  • Strong SQL skills.
  • Experience with at least one cloud platform (AWS preferred).

Responsibilities

  • Data Engineering: Build and maintain ETL pipelines for heterogeneous data sources (traces, logs, transcripts, user feedback).
  • Platform & Observability: Develop dashboards and monitoring tools for AI quality metrics; integrate evaluations into CI/CD pipelines.
  • AI / ML Evaluation Tooling: Apply and extend LLM‑as‑judge evaluation patterns; design metrics for stochastic systems.
  • Collaboration: Partner with data science, engineering, and product teams to define good AI behavior in production.

Skills

Python
SQL
AWS
Data pipelines
4+ years experience

Education

Bachelor's or Master’s in CS/ML/related

Job description

Judi Health is seeking an AI Evaluation Engineer in Charlotte, NC to design and operate robust evaluation frameworks for AI models and autonomous agents. You will partner with scientists and engineers to translate product goals into measurable quality targets and lead end-to-end evaluation from unit tests to online analytics.

The role focuses on data engineering, platform observability, and tooling to support continuous quality and safety benchmarking.

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

AI Evaluation Engineer
AI Evaluation Engineer

Capitalrx • Charlotte (NC)

On-site
USD 134,800 - 168,500
AI Observability & Evaluation Engineer
AI Observability & Evaluation Engineer

Mphasis • Charlotte (NC)

On-site
USD 120,000 - 180,000
AI Evaluation & Safety Engineer
AI Evaluation & Safety Engineer

Nuna • San Francisco (CA)

On-site
USD 150,000 - 230,000
AI Evaluation QA Engineer — ML Testing & Validation
AI Evaluation QA Engineer — ML Testing & Validation

Intellias • Town of Poland (NY)

On-site
USD 120,000 - 160,000
AI Quality & Evaluation Product Lead
AI Quality & Evaluation Product Lead

Jobtailor • Illinois

On-site
USD 120,000 - 155,000
AI Evaluation QA Engineer — Scale, Metrics & Automation
AI Evaluation QA Engineer — Scale, Metrics & Automation

Appnovation • New York (NY)

On-site
USD 90,000 - 130,000
AI Evaluation QA Engineer — Scale & Improve Answer Quality
AI Evaluation QA Engineer — Scale & Improve Answer Quality

Appnovation • Austin (CO)

On-site
USD 90,000 - 150,000
Senior AI QA Engineer — GenAI & LLM Testing Lead
Senior AI QA Engineer — GenAI & LLM Testing Lead

Tata Consultancy Services • Charlotte (NC)

On-site
USD 100,000 - 120,000
Discretionary Annual Incentive
Comprehensive Medical Coverage
Family Leave
+3
Remote Director of AI Quality & Evaluation
Remote Director of AI Quality & Evaluation

Geisinger • Pennsylvania

Hybrid
USD 180,000 - 240,000
Health benefits
Remote work
Senior AI Quality & Evaluation Product Manager
Senior AI Quality & Evaluation Product Manager

RXinsider LTD. • Chicago (IL), Northern (KY)

Hybrid
USD 118,000 - 207,000
Bonus eligibility