AI Safety Evaluator & Model Alignment Specialist

Great Value Hiring

Canada

On-site

CAD 83,000 - 96,000

Full time

14 days+

Get more replies from employers

Send a job-specific resume in minutes.

Job summary

Great Value Hiring is seeking an AI Safety Practitioner to evaluate frontier AI models for safety, quality, and alignment across complex, policy-sensitive topics. You will assess AI-generated responses, apply safety policies, and contribute to improving model behavior through structured evaluations and feedback.

Role entails reviewing content on misinformation, political persuasion, self-harm, violence, cyber, and biosecurity, while collaborating with AI researchers and safety teams on ongoing

Qualifications

  • Bachelor's degree or higher in a related discipline.
  • 5+ years of professional experience in AI Safety, Trust & Safety, journalism, public policy, scientific research, security, or related field.
  • Excellent written English, critical thinking, and analytical reasoning skills.
  • Ability to consistently evaluate nuanced and policy-sensitive scenarios.

Responsibilities

  • Evaluate AI-generated responses for safety, factual accuracy, policy compliance, and overall quality.
  • Review content involving misinformation, political persuasion, self-harm, violence, cyber, biosecurity, and other sensitive domains.
  • Apply and refine evaluation rubrics for RLHF, SFT, and AI safety benchmarking.
  • Identify unsafe outputs, hallucinations, reasoning failures, and policy violations.
  • Provide structured feedback to improve model alignment and safety performance.
  • Collaborate with AI researchers and safety teams on ongoing evaluation initiatives.

Skills

Critical thinking
Analytical reasoning
Written English

Education

Bachelor's degree or higher (Journalism, Communications, Psychology, Public Policy, Law, Biology, Chemistry, CS)

Job description

Great Value Hiring is seeking an AI Safety Practitioner to evaluate frontier AI models for safety, quality, and alignment across complex, policy-sensitive topics. You will assess AI-generated responses, apply safety policies, and contribute to improving model behavior through structured evaluations and feedback.

Role entails reviewing content on misinformation, political persuasion, self-harm, violence, cyber, and biosecurity, while collaborating with AI researchers and safety teams on ongoing

Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

AI Risk Management Specialist
AI Risk Management Specialist

R. L. Polk Mobility LLC • London

On-site
CAD 120,000 - 180,000
AI Risk Architect: Safeguards, Fairness & Reliability
AI Risk Architect: Safeguards, Fairness & Reliability

R. L. Polk Mobility LLC • London

On-site
CAD 120,000 - 180,000
Staff Engineer, Safety for AI Agents
Staff Engineer, Safety for AI Agents

Cohere • Montreal (administrative region)

Hybrid
CAD 120,000 - 180,000
Open and inclusive culture
Collaborative AI research environment
Weekly lunch stipend
+5
Generalist Expert - Content Evaluator
Generalist Expert - Content Evaluator

Mercor • Toronto

On-site
CAD 55,000 - 85,000
Frontier AI Data Engineer for Model Evaluation
Frontier AI Data Engineer for Model Evaluation

Obsidian • Toronto

Remote
CAD 227,000 - 324,000
Remote AI Safety Red Team Specialist
Remote AI Safety Red Team Specialist

Mercor • Toronto

On-site
CAD 90,000 - 140,000
AI Quality Engineer
AI Quality Engineer

Centraprise • Vancouver

On-site
CAD 80,000 - 100,000
Senior Security Engineer - AI Focus
Senior Security Engineer - AI Focus

Euna Solutions • Oakville

On-site
CAD 120,000 - 180,000
GRC AI Training Analyst - Remote Contract
GRC AI Training Analyst - Remote Contract

Alignerr • Toronto

On-site
CAD 41,000 - 83,000
Fully remote
Flexible schedule
Contract extension potential
Remote AI Safety Red Team Specialist
Remote AI Safety Red Team Specialist

Mercor • Toronto

On-site
CAD 154,000 - 224,000