Research Scientist — AI Safety & Misalignment Evaluation

Visa Hunt

Paris

Hybride

EUR 90 000 - 140 000

Plein temps

14 jours+

Recevez plus de réponses des employeurs

Envoyez un CV adapté au poste en quelques minutes.

Avantages offerts par ce poste

Relocation package
Hybrid Paris/London work option
Medical insurance (France)
Hardware and tools provided
Subscriptions for AI agents and IDEs
Team off-sites twice a year

Résumé du poste

White Circle is an AI Safety company focused on evaluating and improving safety, reliability, and optimization for AI systems. We design evals, benchmarks, environments, and tooling to study how AI systems fail and how to prevent unsafe behaviors in user-facing scenarios.

The research team conducts end-to-end studies—from vague questions to reproducible experiments—using white-box and black-box investigations to understand failures and biases in real-world interactions.

Qualifications

  • Empirical research in agent behavior and alignment.
  • Experience designing real-world experiments under varying conditions.
  • Ability to turn vague behavioural questions into concrete experiments and fast iteration.
  • Familiarity with frontier models, AI safety concepts, and interpretability tooling.

Responsabilités

  • Own research projects end to end—from unclear concerns to falsifiable experiments, baselines, and defendable results.
  • Develop automated audit agents that discover and characterize suspect model behaviour at scale.
  • Study misalignment and bias as real users interact with agents; turn findings into evals for products.
  • Publish learnings as public blog posts and conference papers; feed insights back into guardrails.

Connaissances

Agent behavior research
ML engineering
Experiment design
Frontier models
AI safety

Formation

MSc or PhD in machine learning

Description du poste

White Circle is an AI Safety company focused on evaluating and improving safety, reliability, and optimization for AI systems. We design evals, benchmarks, environments, and tooling to study how AI systems fail and how to prevent unsafe behaviors in user-facing scenarios.

The research team conducts end-to-end studies—from vague questions to reproducible experiments—using white-box and black-box investigations to understand failures and biases in real-world interactions.

Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

Research Engineer - AI Safety Benchmarks
Research Engineer - AI Safety Benchmarks

Visa Hunt • Paris

Hybride
EUR 85 000 - 125 000
Paid time off
Hybrid Paris work with relocation
France medical insurance
+3
Research Scientist, AI Safety & Multi-Agent Environments
Research Scientist, AI Safety & Multi-Agent Environments

White Circle • Paris

Hybride
EUR 131 000 - 219 000
Paid time off
Comprehensive medical insurance
Team off-sites twice a year
Research Scientist, AI Safety & Behavior Evaluation
Research Scientist, AI Safety & Behavior Evaluation

Slope • Paris

Hybride
EUR 60 000 - 80 000
Comprehensive medical insurance
Paid time off
Relocation package available
+1
Research Engineer — AI Safety Benchmarks & Guardrails
Research Engineer — AI Safety Benchmarks & Guardrails

White Circle • Paris

Hybride
EUR 131 000 - 219 000
Paid time off
Comprehensive medical insurance
Team off-sites twice a year
Benchmark Engineer, AI Safety & LLM Evaluation
Benchmark Engineer, AI Safety & LLM Evaluation

Aisafety • Paris

Hybride
EUR 80 000 - 110 000
Relocation package
Hybrid work (Paris)
Comprehensive medical insurance
+1
AI Safety Research Scientist: Agent Misbehavior & Alignment
AI Safety Research Scientist: Agent Misbehavior & Alignment

Aisafety • Paris

Hybride
EUR 70 000 - 110 000
Paid time off
Relocation package
Medical insurance (France)
+3
AI Safety Research Scientist — Adversarial Environments
AI Safety Research Scientist — Adversarial Environments

White Circle • Paris

Hybride
EUR 60 000 - 90 000
Paid time off
Comprehensive medical insurance
Covered subscriptions for AI tools
+1
Research Scientist – AI Behaviours
Research Scientist – AI Behaviours

Slope • Paris

Hybride
EUR 60 000 - 80 000
Comprehensive medical insurance
Paid time off
Relocation package available
+1
Research Scientist (AI Behaviours)
Research Scientist (AI Behaviours)

White Circle • Paris

Hybride
EUR 131 000 - 220 000
Relocation package
Comprehensive medical insurance
All hardware, tools & services
+2
Adversarial AI Environment Research Engineer
Adversarial AI Environment Research Engineer

Visa Hunt • Paris

Hybride
EUR 90 000 - 150 000
Equity package
Medical insurance (France)
Relocation support
+1