AI Safety Specialist - Evaluation Expert

Obsidian

Wien

Vor Ort

EUR 70.000 - 100.000

Vollzeit

14 Tage+
Bewerbungsgenerator

Eine vollständige Bewerbung in einer Minute — Lebenslauf und Anschreiben, maßgeschneidert und versandbereit.

Schaffe es an den ATS-Filtern vorbei

Zusammenfassung

Obsidian seeks experienced AI Safety Practitioners to evaluate frontier model safety, quality, and alignment across complex, policy-sensitive topics. You will assess AI outputs and help improve model behavior through structured evaluations.

Join a team of researchers and safety engineers in Vienna to shape responsible AI with rigorous rubrics and actionable feedback across RLHF, SFT, and safety benchmarking.

Qualifikationen

  • 5+ years of professional experience in AI Safety, Trust & Safety, journalism, public policy, scientific research, security, or a related field.
  • Excellent written English, critical thinking, and analytical reasoning skills.
  • Ability to consistently evaluate nuanced and policy-sensitive scenarios.

Aufgaben

  • Evaluate AI-generated responses for safety, factual accuracy, policy compliance, and overall quality.
  • Review content involving misinformation, political persuasion, self-harm, violence, cyber, biosecurity, and other sensitive domains.
  • Apply and refine evaluation rubrics for RLHF, SFT, and AI safety benchmarking.
  • Identify unsafe outputs, hallucinations, reasoning failures, and policy violations.
  • Provide structured feedback to improve model alignment and safety performance.
  • Collaborate with AI researchers and safety teams on ongoing evaluation initiatives.

Kenntnisse

Experience in AI safety
Excellent written English
Critical thinking
Policy-sensitive evaluation

Ausbildung

Bachelor's degree or higher in a related field

Jobbeschreibung

We are seeking experienced AI Safety Practitioners to evaluate the safety, quality, and alignment of frontier AI models across complex, policy-sensitive, and ambiguous ("grey-area") topics. You will assess AI-generated responses, apply safety policies, and help improve model behavior through structured evaluations and feedback.

Responsibilities
  • Evaluate AI-generated responses for safety, factual accuracy, policy compliance, and overall quality.

  • Review content involving misinformation, political persuasion, self-harm, violence, cyber, biosecurity, and other sensitive domains.

  • Apply and refine evaluation rubrics for RLHF, SFT, and AI safety benchmarking.

  • Identify unsafe outputs, hallucinations, reasoning failures, and policy violations.

  • Provide structured feedback to improve model alignment and safety performance.

  • Collaborate with AI researchers and safety teams on ongoing evaluation initiatives.

Required Qualifications
  • Bachelor's degree or higher in Journalism, Communications, Psychology, Sociology, Public Policy, Law, Biology, Chemistry, Computer Science, or a related discipline.

  • 5+ years of professional experience in AI Safety, Trust & Safety, journalism, public policy, scientific research, security, or a related field.

  • Excellent written English, critical thinking, and analytical reasoning skills.

  • Ability to consistently evaluate nuanced and policy-sensitive scenarios.

Preferred Qualifications
  • Experience with AI Safety, RLHF, SFT, Trust & Safety, or AI evaluation.

  • Familiarity with safety policies, content moderation, or evaluation rubric development.

  • Experience reviewing complex, high-risk, or ambiguous content.

Why Join?
  • Shape the safety and behaviour of frontier AI models used by millions worldwide.

  • Work on challenging, real-world safety evaluations across nuanced and high-impact domains.

  • Collaborate with leading AI researchers, engineers, and safety teams.

Hol dir deinen kostenlosen, vertraulichen Lebenslauf-Check.

oder ziehe deine Datei hierhin.

Similar jobs

Ähnliche Jobs, die dir auch gefallen könnten

AI Safety Specialist - Evaluation Expert
AI Safety Specialist - Evaluation Expert

Mercor • Wien

Vor Ort
EUR 90.000 - 125.000
AI Safety Practitioner - Expert Evaluator
AI Safety Practitioner - Expert Evaluator

Mercor • Wien

Vor Ort
EUR 70.000 - 110.000
AI Safety Evaluator: Frontier Model Alignment
AI Safety Evaluator: Frontier Model Alignment

Mercor • Wien

Vor Ort
EUR 90.000 - 125.000
AI Safety Evaluator & Model Alignment Expert
AI Safety Evaluator & Model Alignment Expert

Obsidian • Wien

Remote
EUR 70.000 - 110.000
Senior AI Safety Evaluator for Frontier Models
Senior AI Safety Evaluator for Frontier Models

Mercor • Wien

Vor Ort
EUR 70.000 - 110.000
AI Safety Red Teamer Expert
AI Safety Red Teamer Expert

Mercor • Wien

Vor Ort
EUR 70.000 - 110.000
Frontier AI Safety Evaluator & Alignment Expert
Frontier AI Safety Evaluator & Alignment Expert

Obsidian • Wien

Vor Ort
EUR 70.000 - 100.000
Frontier AI Safety Evaluator — Model Alignment
Frontier AI Safety Evaluator — Model Alignment

Mercor • Wien

Remote
EUR 90.000 - 130.000
Remote Analytical Chemist - AI Safety Evaluation Expert
Remote Analytical Chemist - AI Safety Evaluation Expert

Appsierra Group • Österreich

Vor Ort
Confidential
Remote AI Safety Red Teamer — Expert
Remote AI Safety Red Teamer — Expert

JobsinAustria • Wien

Vor Ort
EUR 83.000 - 100.000