Postdoc: AI Evaluation & Standards for Clinical Ops

Jobtailor

Antwerpen

Sur place

EUR 70 000 - 110 000

Plein temps

14 jours+

Recevez plus de réponses des employeurs

Envoyez un CV adapté au poste en quelques minutes.

Résumé du poste

Jobtailor seeks a researcher to design evaluation frameworks and rubrics for AI agents operating in clinical operations and global development settings. You will define quality dimensions for outputs such as clinical data queries, anomaly detection, and regulatory Q&A content, working with SME s and engineers.

The role involves building benchmark datasets, running human evaluation protocols, and translating findings into measurable improvements for regulated pharma environments.

Qualifications

  • PhD or equivalent research experience in a clinical, biomedical, regulatory, biostatistics, or closely related field.
  • Strong interest in hands-on work with generative AI and agentic systems.
  • Curiosity about LLM behavior in specialized domains and failure modes.
  • Proven ability to develop evaluation frameworks, rubrics, and structured assessment protocols.

Responsabilités

  • Develop evaluation frameworks and rubrics for AI agents in clinical operations and global development contexts.
  • Define quality dimensions for outputs like clinical data queries, anomaly detection, and regulatory documents.
  • Design and run human evaluation protocols with clinical, regulatory, and site-facing experts.
  • Build benchmark datasets and evaluation pipelines used across AI applications.

Connaissances

Python
ML/Data stack
Analytical writing
Interdisciplinary collaboration
Quality assessment design

Formation

PhD in Clinical/ Biomedical/ Regulatory/ Biostatistics

Outils

LLM APIs
Vector databases

Description du poste

Jobtailor seeks a researcher to design evaluation frameworks and rubrics for AI agents operating in clinical operations and global development settings. You will define quality dimensions for outputs such as clinical data queries, anomaly detection, and regulatory Q&A content, working with SME s and engineers.

The role involves building benchmark datasets, running human evaluation protocols, and translating findings into measurable improvements for regulated pharma environments.

Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

Post Doctoral Researcher, Evaluation & Standards – Clinical Operations
Post Doctoral Researcher, Evaluation & Standards – Clinical Operations

Jobtailor • Antwerpen

Sur place
EUR 70 000 - 110 000
AI Content Evaluator & Quality Reviewer (UK/EU)
AI Content Evaluator & Quality Reviewer (UK/EU)

Mercor • Brussel Hoofdstad

Sur place
EUR 42 000 - 64 000
AI Safety Specialist - Evaluation Expert
AI Safety Specialist - Evaluation Expert

Obsidian • Brussel Hoofdstad

Sur place
EUR 70 000 - 110 000
AI Safety Specialist - Evaluation Expert
AI Safety Specialist - Evaluation Expert

Mercor • Brussel Hoofdstad

Sur place
EUR 70 000 - 110 000
AI Safety Practitioner - Expert Evaluator
AI Safety Practitioner - Expert Evaluator

Mercor • Brussel Hoofdstad

Sur place
EUR 70 000 - 110 000
Software Clinical Research Manager
Software Clinical Research Manager

Envista Holdings Corporation • Mechelen

Hybride
EUR 90 000 - 120 000
Remote Psychology QA Lead — Elevating AI Safety & Accuracy
Remote Psychology QA Lead — Elevating AI Safety & Accuracy

YO IT Consulting • Belgique

Sur place
EUR 59 328 - 83 059
Psychology QA Lead - Remote
Psychology QA Lead - Remote

YO IT Consulting • Belgique

Sur place
EUR 59 328 - 83 059
Frontier AI Safety Evaluator & Alignment Specialist
Frontier AI Safety Evaluator & Alignment Specialist

Obsidian • Brussel Hoofdstad

Sur place
EUR 70 000 - 110 000
Frontier AI Safety Evaluator & Alignment Specialist
Frontier AI Safety Evaluator & Alignment Specialist

Mercor • Brussel Hoofdstad

Sur place
EUR 70 000 - 110 000