DevOps Engineer - AI Model Evaluator

Mercor

Lacaussade

Sur place

EUR 84 000 - 119 000

Plein temps

Il y a 8 jours

Recevez plus de réponses des employeurs

Envoyez un CV adapté au poste en quelques minutes.

Résumé du poste

Mercor is seeking a DevOps / SRE / Cloud Engineer on a contract basis to leverage frontier AI coding agents for infrastructure tasks. The role focuses on evaluating model-generated implementations across cloud platforms, Kubernetes, CI/CD, and observability tooling.

You will identify reliability issues, compare model outputs, and apply professional judgment to realistic infrastructure scenarios. Remote work is supported for this position.

Qualifications

  • 2+ years of professional DevOps, SRE, or Cloud Engineering experience.
  • Experience with AWS, Azure, GCP, Kubernetes, Terraform, CI/CD pipelines, or observability tooling.
  • Regular use of AI coding agents such as Cursor, Claude Code, Codex, Windsurf, Gemini CLI.
  • Ability to evaluate model-generated infrastructure and reliability engineering solutions.

Responsabilités

  • Use frontier AI coding agents to complete and evaluate complex infrastructure engineering tasks.
  • Review model-generated implementations involving cloud platforms, Kubernetes, CI/CD systems, observability, and infrastructure automation.
  • Identify bugs, edge cases, reliability issues, and failure modes in model outputs.
  • Compare outputs from multiple frontier models to assess their strengths and weaknesses.
  • Apply professional engineering judgment to realistic infrastructure engineering scenarios.

Connaissances

DevOps experience
Cloud platforms
Kubernetes
Terraform
CI/CD pipelines
observability tooling
AI coding agents
evaluate model outputs

Outils

Cursor
Claude Code
Codex
Windsurf
Gemini CLI

Description du poste

About The Job

Mercor connects elite creative and technical talent with leading AI research labs. Headquartered in San Francisco, our investors include Benchmark, General Catalyst, Peter Thiel, Adam D'Angelo, Larry Summers, and Jack Dorsey.

Position: DevOps / SRE / Cloud Engineer (Coding Agent Experience)

Type: Contract

Compensation: $85/hour

Location: Remote

Role Responsibilities
  • Use frontier AI coding agents to complete and evaluate complex infrastructure engineering tasks.
  • Review model-generated implementations involving cloud platforms, Kubernetes, CI/CD systems, observability, and infrastructure automation.
  • Identify bugs, edge cases, reliability issues, and failure modes in model outputs.
  • Compare outputs from multiple frontier models to assess their strengths and weaknesses.
  • Apply professional engineering judgment to realistic infrastructure engineering scenarios.
Qualifications
Must-Have
  • 2+ years of professional DevOps, SRE, or Cloud Engineering experience.
  • Experience with AWS, Azure, GCP, Kubernetes, Terraform, CI/CD pipelines, or observability tooling.
  • Regular use of AI coding agents such as Cursor, Claude Code, Codex, Windsurf, Gemini CLI, or similar tools.
  • Ability to evaluate model-generated infrastructure and reliability engineering solutions.
Preferred
  • Experience supporting production-scale systems.
Compensation & Legal
  • $400 per accepted task
  • Compensation tied to accepted work.
Obtenez votre examen gratuit et confidentiel de votre CV.
ou faites glisser et déposez votre fichier ici.
Similar jobs

Postes similaires à comparer

DevOps Engineer - AI Model Evaluator
DevOps Engineer - AI Model Evaluator

Mercor • Paris

Sur place
EUR 406 000 - 549 000
Remote DevOps Engineer for AI Model Evaluation
Remote DevOps Engineer for AI Model Evaluation

Mercor • Lacaussade

Sur place
EUR 84 000 - 119 000
AI DevOps Evaluator for Frontier Code Agents
AI DevOps Evaluator for Frontier Code Agents

Mercor • Paris

Sur place
EUR 406 000 - 549 000
Senior Python Engineer - AI Coding Agent Evaluation (Freelance)
Senior Python Engineer - AI Coding Agent Evaluation (Freelance)

Mindrift • France

Sur place
DevOps / MLOps Engineer
DevOps / MLOps Engineer

Jobtailor • Strasbourg

Sur place
EUR 70 000 - 110 000
Freelance Agent Evaluation Analyst
Freelance Agent Evaluation Analyst

Mindrift • Paris

À distance
Flexible working hours
Competitive pay
Remote work options
+1
Applied AI Engineer
Applied AI Engineer

Norbert Health • Paris

Sur place
EUR 70 000 - 90 000
Competitive salary and equity
High autonomy and technical ownership
Transparent, mission-driven culture
AI Agent Evaluation Analyst (Freelance)
AI Agent Evaluation Analyst (Freelance)

Mindrift • France

À distance
Flexible work schedule
Competitive pay up to $50/hour
Valuable experience in AI projects
DevOps - Continuous Integration
DevOps - Continuous Integration

Linuxcareers • Paris

Sur place
EUR 45 000 - 70 000
AI Deployment Engineer - Startups
AI Deployment Engineer - Startups

OpenAI • Paris

Hybride
EUR 50 000 - 70 000